当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

2个月前 (02-25)Deepseek最新资讯135

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。

据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。

贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。

上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

企业微信+DeepSeek来了-企业微信接入DeepSeek

企业微信+DeepSeek来了-企业微信接入DeepSeek

【企业微信接入DeepSeek】《科创板日报》21日讯,今日,企业微信发布新版本,灰度接入满血版DeepSeek-R1大模型,正式发布"智能机器人"、"智能表格-客户跟进...

天融信:公司已发布DeepSeek安全智算一体机

天融信:公司已发布DeepSeek安全智算一体机

新京报贝壳财经讯(记者林子)2月28日,面对投资者询问公司日常是否会借助AI技术辅助工作,赛轮轮胎表示,公司积极探索AI等新技术在相关业务领域的应用,目前公司已私有化部署DeepSeek大模型,目前正...

从钓鱼台到博鳌:“顶流”DeepSeek改变世界的看法

从钓鱼台到博鳌:“顶流”DeepSeek改变世界的看法

“那些对中国科技创新感到惊讶的人,一定是活在石头下,闭上眼睛还捂住了耳朵。”作为AI界的“顶流”,DeepSeek是年后两场高级别论坛的焦点。  “DeepSeek不光在性能上接近世界最好的模型,而且...

约20家车企官宣与DeepSeek深度合作

约20家车企官宣与DeepSeek深度合作

约20家车企官宣与DeepSeek深度合作截至2月14日,已有包括比亚迪、广汽、长安、吉利、奇瑞在内的约20家车企官宣与DeepSeek的深度融合,智能座舱中的人机交互,成为DeepSeek上车后聚焦...

DeepSeek大模型赋能“有诉必应马上办”

DeepSeek大模型赋能“有诉必应马上办”

本报讯(记者 张弘靓)记者从西宁市数据局(市政务服务监管局)获悉,为进一步贯彻习近平总书记考察青海时提出的“切实保障和改善民生,尽力而为、量力而行,多办顺民意、惠民生、暖民心的实事,扎实解决群众急难愁...

什么才是好银行?我问了问DeepSeek

什么才是好银行?我问了问DeepSeek

来源 | 伯虎财经(bohuFN)作者 | 路费在GPT4o用吉卜力AI风格图片刷屏社交网络之前,AI的最大作用是充当许愿机的存在。比如很多人用DeepSeek预测什么彩票能中奖、足球比赛哪支球队能获...