当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

4个月前 (02-26)Deepseek最新资讯234

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

“牵手”DeepSeek,福建监狱开启深度思考时代

“牵手”DeepSeek,福建监狱开启深度思考时代

在国家大力发展新质生产力的背景下福建监狱抢抓AI战略机遇以开展“强基提质 增效赋能”专项行动为契机于2024年初启动AI大模型创新项目试点单位仓山监狱率先完成多轮技术迭代论证在监狱内网部署千亿级参数大...

昇腾+DeepSeek | 推动校园AI解决方案实力迈向新高度

昇腾+DeepSeek | 推动校园AI解决方案实力迈向新高度

      3月20日-21日,“华为中国合作伙伴大会2025”在深圳隆重举行。大会以“因聚而生 众智有为”为主题,众生态伙伴齐聚一堂,凝聚智慧与能力,共同探讨数智化转型...

DeepSeek谈艺 | 岳海涛:斑斓的色彩与悠然的气韵交融,构建出具有东方诗性智慧的视觉叙事体系

DeepSeek谈艺 | 岳海涛:斑斓的色彩与悠然的气韵交融,构建出具有东方诗性智慧的视觉叙事体系

新春以来,DeepSeek成为各个行业所聚焦的热点话题。这个融合了人工智能与大数据分析的前沿平台,正逐步揭开其神秘面纱,展现出对各行各业颠覆性的潜力。随着DeepSeek技术的不断成熟与普及,我们正站...

DeepSeek用户激增1.19亿:低成本模型如何掀起AI平价化浪潮

DeepSeek用户激增1.19亿:低成本模型如何掀起AI平价化浪潮

自2024年起,DeepSeek以“低成本、高性能、强推理”三位一体的技术路径,迅速成为全球AI领域的现象级选手。2024年12月至2025年1月底,其密集推出V3、R1等创新模型,推动全球用户数从3...

人工智能大模型DeepSeek在东莞市人工智能大模型中心完成部署上线

人工智能大模型DeepSeek在东莞市人工智能大模型中心完成部署上线

近日,记者从东莞数字集团获悉,在相关部门指导下,国内领先的人工智能大模型DeepSeek在东莞市人工智能大模型中心完成部署上线,大模型中心将于近期开服上线,为用户提供高质量服务,助力东莞多领域多场景效...

6个在微信使用 DeepSeek的方法,建议收藏

6个在微信使用 DeepSeek的方法,建议收藏

DeepSeek 是杭州深度求索公司开发的开源大模型系列,在自然语言处理领域表现出色。它拥有多个版本,如 DeepSeek-V3 采用混合专家架构,有 6710 亿参数,在基准测试中媲美 GPT -...