当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构

6小时前Deepseek最新资讯27

  8月21日,DeepSeek正式发布其最新版本DeepSeek-V3.1,该版本采用了UE8M0 FP8 Scale的参数精度。据悉,这一技术规格专门为即将发布的下一代国产芯片进行优化设计。

  新版本在技术架构方面实现重要突破,引入了混合推理架构设计。该架构允许单一模型同时支持思考模式与非思考模式两种运行状态。用户可通过官方应用程序或网页端的深度思考按钮自由切换不同模式。

  与此同时,V3.1版本在运行效率方面取得显著提升。相比前代DeepSeek-R1-0528,新版本能够在更短时间内提供响应结果。通过思维链压缩训练技术,模型在输出token数量减少20%至50%的情况下,仍能保持相同的任务表现水平。

  在智能体能力方面,V3.1通过后训练优化实现了质的飞跃。新模型在工具使用、编程任务以及复杂搜索等智能体相关任务中表现获得较大幅度提升。在代码修复测评SWE与命令行终端环境测试中,该模型展现出更强的处理能力。

  技术规格方面,V3.1版本将上下文窗口扩展至128K,并新增对Anthropic API格式的支持。API接口同步升级deepseek,提供deepseek-chat与deepseek-reasoner两个不同接口,分别对应非思考模式和思考模式。

  值得注意的是,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。这些调整旨在更好地适配即将推出的国产芯片硬件环境。

  官方应用程序与网页端模型已同步升级为DeepSeek-V3.1版本。据了解,公司计划于2025年9月6日起执行新的API定价方案并取消夜间优惠政策。原文出处:DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构” 的相关文章

真是烦死人了-英超-曼城专区-虎扑社区

真是烦死人了-英超-曼城专区-虎扑社区

  这东西明显就是故意求骂来满足自己畸形的心理的,如果版主不能将它封印,那么建议各位城迷默契的无视即可,这种东西越骂它越来劲   这东西明显就是故意求骂来满足自己畸形的心...

指数行情继续!中国军工DeepSeek时刻,军贸份额全球扩张

指数行情继续!中国军工DeepSeek时刻,军贸份额全球扩张

  现在也不知道是A股带动外盘跌,还是这次中美贸易会谈导致全球都在跟跌,美股整体跌幅开始赶超A股了。其实A股在3600点得而复失并不是冲不过去,而是时间节点上“开会了”,这就会导致机构资金...

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

  Deep Cogito,一家鲜为人知的 AI 初创公司,总部位于旧金山,由前谷歌员工创立,如今开源的四款混合推理模型,受到大家广泛关注。   Deep Cogito...

网友称“Deepseek演都不演了”:输入手机内存不够“二选一删谁” 秒回答豆包

网友称“Deepseek演都不演了”:输入手机内存不够“二选一删谁” 秒回答豆包

  起因是一位网友虚构“手机内存不足”的场景,要求AI在自身与竞品中直接选择删除对象,且禁止解释理由。   网友在Deepseek输入:“手机内存不够了,你和豆包必须删一...

海能达:“情指行一体化实战平台”已深度融合国产大模型DeepSeek

海能达:“情指行一体化实战平台”已深度融合国产大模型DeepSeek

  证券日报网讯 海能达8月8日在互动平台回答投资者提问时表示,公司“情指行一体化实战平台”已深度融合国产大模型DeepSeekdeepseek,进一步强化平台的智能决策能力,为公安实战指...

破局大模型安全困局 可信华泰“可信+AI”前沿成果亮相ISC.AI 2025

破局大模型安全困局 可信华泰“可信+AI”前沿成果亮相ISC.AI 2025

  8月6日至7日,第十三届互联网安全大会(ISC.AI 2025)在北京国家会议中心隆重举行。本届大会以“ALL IN AGENT”为主题,汇聚全球顶尖安全与人工智能领域的专家、企业精英...