当前位置:首页 > Deepseek应用场景 > 正文内容

DeepSeek-Prover-V2:AI 数学推理新王者,88.9% 通过率设新标杆

3周前 (05-01)Deepseek应用场景71

IT之家 5 月 1 日消息,深度求索(DeepSeek)昨日(4 月 30 日)在 AI 开源社区 Hugging Face 上,发布名为 DeepSeek-Prover-V2-671B 的新模型,随后在 GitHub 等平台上公布了论文信息。

IT之家援引论文介绍,DeepSeek-Prover-V2 是一款专注于形式化数学推理的开源大型语言模型,基于 DeepSeek-V3-0324,通过递归定理证明管道生成初始数据。

Deepseek 推出了 DeepSeek-Prover-V2-671B(结合 V3 基础大模型)、DeepSeek-Prover-V2-7B(增强模型)两个模型,以及 DeepSeek-ProverBench 数据集。

DeepSeek-Prover-V2-671B 采用和 DeepSeek V3-0324 相同的架构,并非用于常规对话或者推理,而是用于形式化定理证明、专门增强数学能力的模型。

DeepSeek 团队首先引导 DeepSeek-V3 模型将复杂定理分解为一系列子目标(subgoals),整合非形式与形式化数学推理,在 Lean 4 平台上形式化证明步骤。

接着,利用一个较小的 7B 参数模型处理子目标的证明搜索,减轻计算负担。最终,结合完整的逐步证明与 DeepSeek-V3 的思维链(chain-of-thought),形成强化学习的“冷启动”数据。

在训练中,团队筛选出一批 7B 模型无法直接解决但子目标已被证明的难题。通过整合子目标证明,形成完整的形式化证明,并与 DeepSeek-V3 的推理过程对接,生成合成数据。

随后,模型微调这些数据,并通过强化学习进一步提升能力,以二元反馈(正确或错误)作为奖励机制。最终,DeepSeek-Prover-V2-671B 在神经定理证明领域创下新高,在 MiniF2F-test 数据集上通过率达 88.9%,在 PutnamBench 数据集中解决 658 个问题中的 49 个。

团队还发布了 ProverBench 基准数据集,包含 325 个形式化数学问题。其中,15 个问题源自近期 AIME 竞赛(AIME 24 和 25),涉及数论与代数,代表高中竞赛难度。

其余 310 个问题则来自精选教材和教学内容,涵盖线性代数、微积分、概率等多个领域。这一数据集旨在为高中竞赛和本科数学提供全面评估标准,推动模型在多样化场景下的测试与应用。

相关阅读:

《DeepSeek-Prover-V2-671B 新模型开源发布》


“DeepSeek-Prover-V2:AI 数学推理新王者,88.9% 通过率设新标杆” 的相关文章

创力集团:正在积极探索设备接入DeepSeek相关技术或平台

创力集团:正在积极探索设备接入DeepSeek相关技术或平台

e公司讯,创力集团(603012)2月18日在互动平台表示,公司正在积极探索设备接入DeepSeek相关技术或平台。公司研发团队在AI算法优化、数据处理及自动化控制等领域有丰富经验,利用DeepSee...

DeepSeek全攻略:入门到精通附讲解视频本地电脑部署教程

DeepSeek全攻略:入门到精通附讲解视频本地电脑部署教程

【好课推荐】DeepSeek全攻略:入门到精通附讲解视频本地电脑部署教程 在当今数字化时代,人工智能技术飞速发展,深度学习更是成为了热门领域。DeepSeek作为一款强大的工具,为深度学习爱...

Ai赋能,义乌老板已用DeepSeek卖货……

Ai赋能,义乌老板已用DeepSeek卖货……

如今,人工智能以极快的速度走进我们的生活,浙江义乌小商品市场的商户们也紧跟浪潮,玩出了新花样——利用DeepSeek大模型,他们不仅成功将商品推向国际市场,还“秒学”36种外语,成为了“国际交流小能手...

宝马中国宣布DeepSeek“上车” 以AI赋能宝马人机交互体验

宝马中国宣布DeepSeek“上车” 以AI赋能宝马人机交互体验

宝马集团以AI创新引擎驱动战略纵深,加速中国AI战略落地。继与阿里巴巴达成AI大语言模型战略合作后,宝马再度深化本土AI生态布局,宝马中国宣布接入DeepSeek。未来,DeepSeek功能也将应用于...

刘慈欣称 DeepSeek 暂时不太会替代科幻作家

刘慈欣称 DeepSeek 暂时不太会替代科幻作家

IT之家 3 月 30 日消息,DeepSeek 未来有可能替代科幻作家吗?据央视财经昨日报道,科幻作家刘慈欣表示,暂时不太会,但是再过 10 年、20 年,从理论上说完全可能代替科幻小说作家。刘慈欣...

DeepSeek对未来就业有何影响?

DeepSeek对未来就业有何影响?

据新民晚报报道:2月17日上午,民营企业座谈会在首都北京召开。参与此次座谈会的民营企业代表包括华为创始人任正非、DeepSeek创始人梁文锋、腾讯创始人马化腾、宇树科技创始人王兴兴、比亚迪创始人王传福...