当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

8个月前 (02-26)Deepseek最新资讯463

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

托普云农:目前暂无与DeepSeek合作计划

托普云农:目前暂无与DeepSeek合作计划

每经AI快讯,托普云农(301556)2月24日在互动平台表示,公司一直积极关注行业内的技术发展,但目前暂无与DeepSeek合作计划。未来,公司将持续深耕智慧农业行业,提升技术水平,在农业大数据分析...

中美Robotaxi狂飙量产:自动驾驶进入DeepSeek时刻

中美Robotaxi狂飙量产:自动驾驶进入DeepSeek时刻

打造可复制的商业模板,成为自动驾驶领域的DeepSeek,或许才是Momenta在L4的目标。作者|杨 铭编辑|刘珊珊无人驾驶出租车撕开雨幕,在城市高楼林立间疾驰,成为城市出行重要参与者——这是人类对...

周鸿祎:建议对DeepSeek“幻觉”给予适度包容

周鸿祎:建议对DeepSeek“幻觉”给予适度包容

 中国青年报客户端北京3月5日电(中青报·中青网记者 周围围 李华锡)今年全国两会,全国政协委员、360集团创始人周鸿祎关注大模型话题。他认为,DeepSeek通过大模型技术范式的重大突破,让大模型加...

我问Deepseek,人如何才能大彻大悟,看完答案我醒了

我问Deepseek,人如何才能大彻大悟,看完答案我醒了

原创 洞见 洞见洞见(DJ00123987)——不一样的观点,不一样的故事,2000万人订阅的微信大号。点击标题下蓝字“洞见”关注,我们将为您提供有价值、有意思的延伸阅读。作者:洞见yimo钱塘江上潮...

DeepSeek、Manus相继火了,产业政策怎样“抢时间”?

DeepSeek、Manus相继火了,产业政策怎样“抢时间”?

“经济主题记者会,快变成科技主题记者会了。”今年全国两会期间,证监会主席吴清开玩笑说,这两天,谁要是不说说DeepSeek,好像就不太时髦似的。话音未落,又一款国产AI产品Manus横空出世,迅速走红...

“DeepSeek们”爆改短剧,15天完成100集

“DeepSeek们”爆改短剧,15天完成100集

文 | 锌刻度,作者 | 李觐麟当周鸿祎下场演短剧《红衣大叔用AI带我穿越》,为自家的纳米AI站台;当AI动漫短剧《我靠嘴贱登上修真巅峰》开播即引发热潮,单部剧当期收入超过30万元;当央视频、博纳影业...