当前位置:首页 > Deepseek应用场景 > 正文内容

DeepSeek-Prover-V2:AI 数学推理新王者,88.9% 通过率设新标杆

4个月前 (05-01)Deepseek应用场景321

IT之家 5 月 1 日消息,深度求索(DeepSeek)昨日(4 月 30 日)在 AI 开源社区 Hugging Face 上,发布名为 DeepSeek-Prover-V2-671B 的新模型,随后在 GitHub 等平台上公布了论文信息。

IT之家援引论文介绍,DeepSeek-Prover-V2 是一款专注于形式化数学推理的开源大型语言模型,基于 DeepSeek-V3-0324,通过递归定理证明管道生成初始数据。

Deepseek 推出了 DeepSeek-Prover-V2-671B(结合 V3 基础大模型)、DeepSeek-Prover-V2-7B(增强模型)两个模型,以及 DeepSeek-ProverBench 数据集。

DeepSeek-Prover-V2-671B 采用和 DeepSeek V3-0324 相同的架构,并非用于常规对话或者推理,而是用于形式化定理证明、专门增强数学能力的模型。

DeepSeek 团队首先引导 DeepSeek-V3 模型将复杂定理分解为一系列子目标(subgoals),整合非形式与形式化数学推理,在 Lean 4 平台上形式化证明步骤。

接着,利用一个较小的 7B 参数模型处理子目标的证明搜索,减轻计算负担。最终,结合完整的逐步证明与 DeepSeek-V3 的思维链(chain-of-thought),形成强化学习的“冷启动”数据。

在训练中,团队筛选出一批 7B 模型无法直接解决但子目标已被证明的难题。通过整合子目标证明,形成完整的形式化证明,并与 DeepSeek-V3 的推理过程对接,生成合成数据。

随后,模型微调这些数据,并通过强化学习进一步提升能力,以二元反馈(正确或错误)作为奖励机制。最终,DeepSeek-Prover-V2-671B 在神经定理证明领域创下新高,在 MiniF2F-test 数据集上通过率达 88.9%,在 PutnamBench 数据集中解决 658 个问题中的 49 个。

团队还发布了 ProverBench 基准数据集,包含 325 个形式化数学问题。其中,15 个问题源自近期 AIME 竞赛(AIME 24 和 25),涉及数论与代数,代表高中竞赛难度。

其余 310 个问题则来自精选教材和教学内容,涵盖线性代数、微积分、概率等多个领域。这一数据集旨在为高中竞赛和本科数学提供全面评估标准,推动模型在多样化场景下的测试与应用。

相关阅读:

《DeepSeek-Prover-V2-671B 新模型开源发布》


“DeepSeek-Prover-V2:AI 数学推理新王者,88.9% 通过率设新标杆” 的相关文章

四川自贡举行小学科学教学研讨会 教师将AI数字人、DeepSeek融入课堂

四川自贡举行小学科学教学研讨会 教师将AI数字人、DeepSeek融入课堂

5月16日,自贡市2024-2025学年下学期小学科学教学研讨会,在自贡市汇东实验学校成功举办。本次活动以“深耕科学课堂,点燃创新梦想”为主题,通过教学研讨与校园科技节双线并行,展现科学教育实践成果,...

调用 DeepSeek 时传入的参数有哪些?

调用 DeepSeek 时传入的参数有哪些?

调用 DeepSeek 时传入的参数有哪些?在使用 DeepSeek API 进行调用时,可以传入多个参数来控制 API 的行为和输出内容。这些参数包括:Model:指定使用的模型名称,例如 ...

50个DeepSeek高阶提示词,一键职场开挂!(附下载)

50个DeepSeek高阶提示词,一键职场开挂!(附下载)

“ 知识就是力量,科技就是生产力!”在快节奏的现代生活中,我们总是在寻找那些能够让我们事半功倍的秘密武器。今天,我要向大家强烈推荐一份宝藏资料——《DeepSeek50个高阶提示词.pdf》...

DeepSeek+水利 治水迎“智”变

DeepSeek+水利 治水迎“智”变

今年以来,随着以DeepSeek为代表的人工智能技术向垂直领域加速渗透,水利行业也迎来新一轮技术应用变革。目前,全省水利系统正积极开展“DeepSeek+水利”的相关应用,除了已经上线“DS都江堰”智...

石头科技旗下Roborock APP接入DeepSeek

石头科技旗下Roborock APP接入DeepSeek

中证报中证网讯(记者 张兴旺)2月21日,石头科技官方微博发布海报,旗下Roborock APP已完成DeepSeek-R1接入,并将于近期正式上线。据悉,石头科技作为头部智能硬件公司,在DeepSe...

DeepSeek发布免费网页版服务-DeepSeek发布官方渠道说明:官方网页端与App内不含广告和付费项目

DeepSeek发布免费网页版服务-DeepSeek发布官方渠道说明:官方网页端与App内不含广告和付费项目

自 DeepSeek-R1 模型 1 月 20 日发布至今,已经过去了半个多月的时间。海内外全网都见证了其强大的力量。据悉,官方提供免费的网页版服务,并且其API价格远低于OpenAI o1。这引起了...