当前位置:首页 > Deepseek最新资讯 > 正文内容

国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新

2周前 (08-27)Deepseek最新资讯109

  发布研报称,DeepSeek V3.1在多项指标上性能大幅领先R1-0528,加强了智能体支持,独创性使用UE8M0 FP8 Scale精度,与国产AI芯片协同创新。DeepSeek-V3.1加强了智能体支持,并且针对下一代国产AI芯片设计;该行维持计算机板块“增持”评级。

  ①混合推理架构,一个模型同时支持思考模式和非思考模式,官方App与网页端模型已同步升级为DeepSeek-V3.1,用户可以通过“深度思考”按钮,实现思考模式和非思考模式自由切换;②更高的思考效率,相比DeepSeek-R1-0528deepseek,DeepSeek-V3.1-Think能在更短时间内给出答案;③更强的Agent能力,通过Post-Training优化,新模型在工具使用与智能体任务中的表现有较大提升。

  ①编程智能体,在代码修复测评SWE与命令行终端环境下的复杂任务(Terminal-Bench)测试中,DeepSeek-V3.1相比之前的DeepSeek系列模型有明显提高。②搜索智能体,DeepSeek-V3.1在多项搜索评测指标上取得了较大提升。在需要多步推理的复杂搜索测试(browsecomp)与多学科专家级难题测试(HLE)上,DeepSeek-V3.1性能已大幅领先R1-0528。③思考效率提升,测试结果显示,经过思维链压缩训练后,V3.1-Think在输出token数减少20%-50%的情况下,各项任务的平均表现与R1-0528持平。同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于DeepSeek-V3-0324,能够在输出长度明显减少的情况下保持相同的模型性能。

  ①V3.1的Base模型在V3的基础上重新做了外扩训练,一共增加训练了840Btokens。Base模型与后训练模型均已在Hugging face与魔搭开源。②需要注意的是,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度,UE8M0 FP8是针对即将发布的下一代国产芯片设计。③另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。

  /特朗普:已有人选接替库克,鲍威尔也很快就离开了!美联储首次回应, 库克的律师宣布将起诉......

  /这次没有空中爆炸!1个小时飞越半个地球,马斯克星舰终于成功了,现场欢呼声、鼓掌声响成一片

  /苹果发布会前瞻:iPhone 17—“史上最薄iPhone”,以及苹果硬件发布会的其他预期新品

  /中国石油拟400亿元人民币收购储气库企业:德国汽车欧宝放弃先前电动化战略,延长燃油车型供应时间原文出处:国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新,感谢原作者,侵权必删!

标签: deepseek

“国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新” 的相关文章

DeepSeek预测:国际米兰vs乌迪内斯!蓝黑军团火力全开,劳塔罗领衔屠杀?

DeepSeek预测:国际米兰vs乌迪内斯!蓝黑军团火力全开,劳塔罗领衔屠杀?

  意甲第2轮焦点战,卫冕冠军国际米兰坐镇梅阿查迎战中游球队乌迪内斯。蓝黑军团首轮5-0血洗都灵,以净胜球优势领跑积分榜;乌迪内斯则1-1战平维罗纳,暂列第13。本场胜负将直接影响争冠与保...

外媒:OpenAI发布开源模型与DeepSeek展开竞争

外媒:OpenAI发布开源模型与DeepSeek展开竞争

  中新网8月7日电(记者 张乃月)当地时间5日,OpenAI发布了两款“开放权重”模型GPT-oss-120b和GPT-oss-20b,可以根据用户提示生成文本,但不支持图像或视频。英国...

张成教练:樊振东一年没跟队训练,还那么厉害

张成教练:樊振东一年没跟队训练,还那么厉害

  肌肉记忆了属于是,一阶段第一场对徐瑛彬的时候,还各种失误出台,明显手还是生了不少,后边手感就越来越好了,真就是以赛代练了   肌肉记忆了属于是,一阶段第一场对徐瑛彬的...

DTCC2025丨达梦以智算多模与AI创新引领行业变革

DTCC2025丨达梦以智算多模与AI创新引领行业变革

  近日,由IT168联合旗下ITPUB、ChinaUnix两大技术社区主办的第16届中国数据库技术大会(DTCC2025)在京隆重召开。本次大会以“智能创新 数赢未来”为主题,超百位行业...

DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构

DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构

  8月21日,DeepSeek正式发布其最新版本DeepSeek-V3.1,该版本采用了UE8M0 FP8 Scale的参数精度。据悉,这一技术规格专门为即将发布的下一代国产芯片进行优化...

中裕能源“WebGIS+AI”模式荣膺2025智慧燃气优秀应用案例

中裕能源“WebGIS+AI”模式荣膺2025智慧燃气优秀应用案例

  近日,由中国城市燃气协会智能气网专委会主办的2025“引领燃气高质量发展·智慧燃气优秀应用案例”评选结果正式揭晓。中裕能源“WebGIS+AI双轮智驱:构建全生命周期感知与治理新模式”...