当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

1个月前 (03-26)DeepSeek技术交流118

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

DeepSeek预测2025年高考十大热门填报专业,结果让人意外

DeepSeek预测2025年高考十大热门填报专业,结果让人意外

今天,我们一同探讨DeepSeek对2025年高考热门专业的预测,剖析这些专业是否真的具备吸引力,值得广大学子的关注。一、智能科技与大数据——数字经济的支柱智能科技与大数据,作为数字经济的核心领域,正...

东方国信推出新一代满血版“幕僚DeepSeek一体机”

东方国信推出新一代满血版“幕僚DeepSeek一体机”

人民财讯3月10日电,东方国信发文称,公司充分发挥自身在算力基础设施、行业大数据积累及垂直大模型领域的核心优势,重磅推出新一代满血版“幕僚DeepSeek一体机”。...

江夏完成DeepSeek大模型私有化部署

江夏完成DeepSeek大模型私有化部署

2月28日江夏区融媒体中心在智能化转型进程中又取得重要突破正式在融媒体生产平台接入DeepSeek大模型江夏也成为了全市首个完成政务环境DeepSeek大模型私有化部署并将其应用于区内主流媒体的城区“...

ST广网:公司“秦岭云”平台已完成DeepSeek本地化部署

ST广网:公司“秦岭云”平台已完成DeepSeek本地化部署

每经AI快讯,有投资者在投资者互动平台提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考量?如果公...

快手搜索已全面接入DeepSeek R1

快手搜索已全面接入DeepSeek R1

3月21日,华尔街见闻获悉,快手搜索已全面接入DeepSeek R1的大模型能力,旨在优化搜索效果与用户体验,并进一步提升用户活跃度,未来也会持续探索智能搜索场景的商业化变现能力。(全天候科技)...

百度搜索宣布将全面接入DeepSeek及文心大模型深度搜索功能

百度搜索宣布将全面接入DeepSeek及文心大模型深度搜索功能

【百度搜索宣布将全面接入DeepSeek及文心大模型深度搜索功能】财联社2月16日电,百度搜索和文心智能体平台宣布将全面接入DeepSeek和文心大模型最新的深度搜索功能。搜索用户可免费使用DeepS...