当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

2个月前 (02-26)Deepseek最新资讯167

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

互联网正在沦为“信息垃圾场”,真的是DeepSeek们的错吗?

互联网正在沦为“信息垃圾场”,真的是DeepSeek们的错吗?

“那是最美好的时代,那是最糟糕的时代;那是智慧的年头,那是愚昧的年头……”一百多年前,狄更斯在《双城记》开篇写下的句子,精准描绘出两次工业革命交替之际希望与危机并存的矛盾局面。如今,在人工智能的浪潮中...

九江市教育局举办“DeepSeek等人工智能技术赋能教育图景”专题讲座

九江市教育局举办“DeepSeek等人工智能技术赋能教育图景”专题讲座

为积极响应国家教育数字化战略行动,进一步推动人工智能技术与教育教学的深度融合,提升我市教育现代化水平,市教育局精心筹备并举办了 “DeepSeek等人工智能技术赋能教育图景” 专题讲座。市教育局在家班...

DeepSeek爆火,这些套路要小心!

DeepSeek爆火,这些套路要小心!

近期AI大模型DeepSeek强势出圈如同一位得力助手深度融入人们的生活与工作带来了极大的便利让使用者们赞不绝口然而DeepSeek的爆火也吸引了不法分子的贪婪目光妄图借DeepSeek之名施展五花八...

企业微信接入DeepSeek!AI成企业数智化最后的拼图?

企业微信接入DeepSeek!AI成企业数智化最后的拼图?

2月21日,企业微信正式上线智能机器人、智能表格等AI应用,并宣布接入满血版DeepSeek-R1,让企业微信正式融入AI生态圈。说起来,普通微信接入AI其实也就是不久之前的事情,雷科技也在第一时间做...

北京市监局通过百度智能云千帆接入DeepSeek

北京市监局通过百度智能云千帆接入DeepSeek

3月5日,据百度智能云消息,北京市市场监管局企业登记注册场景近日通过百度智能云千帆大模型平台接入DeepSeek大模型,实现企业登记注册业务24小时在线“智能咨询”服务。...

DeepSeek带动对冲基金快速涌入中国股市

DeepSeek带动对冲基金快速涌入中国股市

据彭博社16日报道,中国人工智能公司DeepSeek的技术突破,正促使股票资金从印度回流到中国。彭博社称,随着DeepSeek推动中国科技行业形势看涨,以及中国将出台更多利好经济措施的预期,全球对冲基...