当前位置:首页 > DeepSeek技术交流 > 正文内容

文心大模型X1对上最新版DeepSeek V3,表现谁更好?

4个月前 (03-27)DeepSeek技术交流304

3月26日,在多个公开数据集测评中,百度最新发布的文心大模型X1,在数学、代码、推理等能力上表现优异,超越升级后的DeepSeek-V3-0324。

在数学场景中,GSM8K数据集测试后结果显示,文心X1得分95.6,DeepSeek-V3-0324得分93.6;代码生成层面,HumanEval数据集测试后结果显示,文心X1得分90.9,DeepSeek-V3-0324得分86.6;在知识推理层面,C-Eval数据集测试后结果显示,文心大模型X1得分88.6,DeepSeek-V3-0324得分85.1。

近日,DeepSeek官方宣布V3模型完成小版本升级的消息,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。

而在不久前,百度正式发布文心大模型X1,具备更强的理解、规划、反思、进化能力。文心X1由百度的慢思考技术发展而来。作为能力更全面的深度思考模型,兼备准确、创意和文采,在中文知识问答、文学创作、文稿写作、日常对话、逻辑推理、复杂计算及工具调用等方面表现尤为出色。

据悉,文心大模型X1即将上线千帆大模型平台,API调用价格为DeepSeek-R1调用价格的50%。


“文心大模型X1对上最新版DeepSeek V3,表现谁更好?” 的相关文章

360推出DS大模型安全解决方案 守护DeepSeek发展

360推出DS大模型安全解决方案 守护DeepSeek发展

360集团基于对大模型安全风险的深入研究,推出DS大模型安全解决方案,旨在覆盖大模型训练、推理、运营等全过程,促进国产大模型企业向安全、向善、可信、可控的方向发展。该方案针对系统安全、数据安全、内容安...

量化私募巨头纷纷宣布布局AI大模型,会有新的DeepSeek诞生吗?

量化私募巨头纷纷宣布布局AI大模型,会有新的DeepSeek诞生吗?

作为一名投资者,李萌很久之前就关注到量化私募巨头幻方量化在研究大模型,但是直到今年年初DeepSeek爆火以后,才试用到这款大模型,“原来量化私募做出来的大模型竟然这么好用”。自从DeepSeek爆火...

硅谷视角深聊:Deepseek的颠覆、冲击、争议和误解

硅谷视角深聊:Deepseek的颠覆、冲击、争议和误解

2024年12月底,中国幻方量化旗下的人工智能团队,发布了6700亿参数大语言基础模型DeepSeek V3,紧接着在2025年1月20日开源了基于V3的两款推理模型:DeepSeek-R1-Zero...

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。据了解,MLA(多头潜在注意力机制)正是D...

钉钉宣布全面接入DeepSeek系列模型

钉钉宣布全面接入DeepSeek系列模型

  2025年2月17日,钉钉正式启动第八届开工节,宣布全面接入DeepSeek系列模型,并推出四大AI礼包,为企业提供“开箱即用”的智能化解决方案,覆盖协同办公、数据处理、应用开发及专属模型定制等领...

Manus引爆智能体复现潮,DeepSeek已被整合

Manus引爆智能体复现潮,DeepSeek已被整合

Manus背后公司名为“蝴蝶效应”,真的带火了整个智能体赛道:开源复现潮出现了,商业闭源产品也卷起来了。‍‍‍目前进度最快的两个项目,都是在Manus发布的第0天就发布了复现代码。除了之前介绍的Ope...