当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库

5个月前 (02-25)Deepseek最新资讯308

【DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库】财联社2月25日电,DeepSeek在“开源周”的第二天向公众开源了DeepEP。据介绍,DeepEP是第一个用于MoE(混合专家)模型训练和推理的EP(Expert Parallelism,专家并行)通信库,可以实现高效且优化的全对全通信,支持包括FP8在内的低精度运算,适配现代高性能计算需求。同时,DeepEP针对NVLink到RDMA的非对称带宽转发场景进行了深度优化,不仅提供了高吞吐量,还支持SM(Streaming Multiprocessors)数量控制,兼顾训练和推理任务的高吞吐量表现。对于延迟敏感的推理解码场景,DeepEP还提供了纯RDMA的低延迟内核,支持自适应路由,能实现更灵活的GPU资源控制,满足不同场景需求。

“DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库” 的相关文章

一周两场,场场火爆!Deepseek+数字人营销训练营吸引百余位青岛企业家参加:必须学会新武器

一周两场,场场火爆!Deepseek+数字人营销训练营吸引百余位青岛企业家参加:必须学会新武器

面对人力成本攀升、爆款内容稀缺、矩阵账号管理低效等难题,AI已成为企业降本增效的“救命稻草”。4月17日-18日,由半岛都市报风口财经联合青岛市女企业家协会、青岛市时装设计师协会、小冰华北运营中心举办...

Deepseek打通招聘全流程讲座在合肥智能科技园举办

Deepseek打通招聘全流程讲座在合肥智能科技园举办

3月13日,区团工委联合青企协、恒创智能公司、合肥海诚公司、智联招聘合肥分公司、合肥市工业互联网协会、合肥梦海创业孵化器管理有限公司举办Deepseek打通招聘全流程专场培训讲座,区内70余家企业的人...

中国电信丽水分公司完成Deepseek本地化部署

中国电信丽水分公司完成Deepseek本地化部署

近日,丽水政务云成功部署DeepSeek-R1多版本模型,本次部署的DeepSeek-R1模型在政务外网内,具备14B、32B等多版本模型能力。丽水政府首个DeepSeek大模型应用落地上线,丽水分公...

深圳市大鹏新区开启DeepSeek新型智慧政务模式

深圳市大鹏新区开启DeepSeek新型智慧政务模式

2月17日,深圳市大鹏新区顺利完成DeepSeek-R1(671B)满血版模型的私有化部署,将实现公文写作、民生服务、旅游交通等6大类18项AI政务场景全覆盖,构建起“对话即办事”“感知即处置”的新型...

传化智联接入DeepSeek 加速物流产业新质生产力发展

传化智联接入DeepSeek 加速物流产业新质生产力发展

在全国两会热议科技创新与产业升级的背景下,全国人大代表、传化集团董事长徐冠巨提出"大力推动人工智能与产业创新融合,赋能新质生产力发展"的建议,引发物流行业高度关注。徐冠巨指出:&q...

百度、微信接入DeepSeek

百度、微信接入DeepSeek

中国互联网行业再迎标志性技术事件。2月16日晚,百度搜索和文心智能体平台宣布将全面接入DeepSeek。搜索用户可免费使用DeepSeek和文心大模型深度搜索功能,文心智能体平台的开发者也将随时调用D...