当前位置:首页 > Deepseek应用场景 > 正文内容

比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1

2个月前 (04-11)Deepseek应用场景160

近日,硅基流动创始人袁进辉在华为云生态大会上宣布,硅基流动联合华为云基于 CloudMatrix 384超节点昇腾云服务和高性能推理框架 SiliconLLM,用大规模专家并行最佳实践正式上线 DeepSeek-R1。

该服务在保证单用户 20 TPS水平前提下,单卡 Decode吞吐突破 1920 Tokens/s,可比肩 H100 部署性能。同时,经过主流测试集验证及大规模线上盲测,在昇腾算力部署 DeepSeek-R1的模型精度与 DeepSeek官方保持一致。


其中,通过架构的全面创新,基于新型高速总线架构的 CloudMatrix超节点集群在总算力、互联带宽、内存带宽上领先业界。

此前,硅基流动在大模型云服务平台 SiliconCloud首发推出了基于昇腾云的稳定生产级 DeepSeek-V3 & R1 推理服务,并支持模型私有化集群部署,这次合作推动基于国产算力的 DeepSeek-R1推理服务持续升级。


DeepSeek风暴席卷全球,特别是以其高效、低成本的 MoE架构为应对大模型推理挑战打开了局面。不过,如果没有强大的 AI Infra 技术能力,要想部署好 DeepSeek并非易事。

DeepSeek使用了大规模专家并行(Expert Parallelism,大 EP并行)的 MoE模型架构,若采用单机部署方案,最终的性能远不如 DeepSeek官方公布的部署方案,且至少有数倍成本差距。更具挑战的是,虽然 DeepSeek公开了大 EP 并行方案,但技术难度较大,业内还没有其他团队快速复现这一部署方法。

针对这些难题,硅基流动与华为云联合攻关实现了技术突破。我们在 CloudMatrix 384超节点昇腾云服务上部署 DeepSeek-R1 时采纳了大规模专家并行方案,通过多专家负载均衡和极致通信优化,实现高吞吐及更高性能,大幅提升了用户体验。同时,我们使用昇腾高性能算子库,以及硅基流动推理加速框架 SiliconLLM在模型、机制、算子上的协同优化,实现在国产算力上,不损失模型精度的情况下,获得 DeepSeek-R1 推理效率与资源利用率的显著提升。

硅基流动与华为云的合作不仅提供坚实的全国产软硬件体系部署方案,让 DeepSeek推理服务更经济高效,也展现了 AI 生态合作的强大能量。硅基流动将继续加深与华为云的联合创新,共同提升产品体验,加速模型在更多场景落地。


“比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1” 的相关文章

新里程:旗下医院均已上线DeepSeek应用

新里程:旗下医院均已上线DeepSeek应用

金融界4月21日消息,有投资者在互动平台向新里程提问:董秘您好,请问贵公司体内医院接入DeepSeek并进行本地化部署了吗?公司回答表示:目前公司旗下医院均已上线DeepSeek应用,将实现7*24运...

放大 AI 商业价值,企业快成长 DeepSeek 行业深度应用创新论坛华北站圆满落幕

放大 AI 商业价值,企业快成长 DeepSeek 行业深度应用创新论坛华北站圆满落幕

DeepSeek 一经问世便迅速赢得了众多用户的青睐,彼时,公众对 AI 的强烈需求直接体现在了注册数量上。经过多次迭代,DeepSeek-R1 和 DeepSeek-V3 现已发展成为能够进行深度思...

伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会

伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会

中新网黑龙江新闻3月22日电(刘璐)2025年3月21日,伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会。市委网信办、市网络安全应急指挥中心全体工作人员,各县(市)区委网信办全体干部...

黄山市政府网站集约化平台已正式接入DeepSeek大模型

黄山市政府网站集约化平台已正式接入DeepSeek大模型

以下文章来源于黄山日报 ,作者黄山日报黄山日报.在这里,读懂黄山阅尽徽州。 | 互联网新闻信息服务许可证编号:341201800122月19日,记者从市数据资源管理局获悉,黄山市政府网站集约化平台已正...

怎么修改 DeepSeek 的返回值的数据类型?

怎么修改 DeepSeek 的返回值的数据类型?

怎么修改 DeepSeek 的返回值的数据类型?要修改 DeepSeek 的返回值数据类型,可以通过调整模型的输出配置或使用适当的数据处理方法来实现。以下是一些可能的步骤:明确输出要求:在发送请求时,...

“牵手”DeepSeek,福建监狱开启深度思考时代

“牵手”DeepSeek,福建监狱开启深度思考时代

在国家大力发展新质生产力的背景下福建监狱抢抓AI战略机遇以开展“强基提质 增效赋能”专项行动为契机于2024年初启动AI大模型创新项目试点单位仓山监狱率先完成多轮技术迭代论证在监狱内网部署千亿级参数大...