智快网
快讯 行业 产业 汽车 科技 AI+ 热点

DeepSeek-Prover-V2数学推理新突破,88.9%通过率引领AI新标杆!

2025-05-01来源:ITBEAR编辑:瑞雪

近日,AI 开源社区 Hugging Face 迎来了一项新成果,深度求索(DeepSeek)团队发布了名为 DeepSeek-Prover-V2-671B 的大型语言模型。与此同时,该团队还在 GitHub 等平台分享了相关论文,详细介绍了这一新模型的特性和成就。

DeepSeek-Prover-V2 是一款专注于形式化数学推理的开源模型,其基础是 DeepSeek-V3-0324。为了生成训练所需的初始数据,团队采用了递归定理证明管道的方法。这一创新使得模型在处理复杂数学问题时,能够展现出更高的精确度和效率。

DeepSeek 团队推出了两个版本的模型:DeepSeek-Prover-V2-671B 和 DeepSeek-Prover-V2-7B。前者结合了 V3 基础大模型的优点,后者则是一个增强模型。团队还发布了 DeepSeek-ProverBench 数据集,为评估模型性能提供了有力工具。

DeepSeek-Prover-V2-671B 的架构与 DeepSeek V3-0324 相同,但其应用场景却大相径庭。这款模型并非用于常规对话或推理,而是专注于形式化定理证明,专门增强了数学能力。为了实现这一目标,团队采用了复杂的策略。

首先,他们引导 DeepSeek-V3 模型将复杂的数学定理分解为一系列子目标。这一步骤整合了非形式化与形式化数学推理,使得模型能够在 Lean 4 平台上逐步完成形式化证明。接着,团队利用一个较小的 7B 参数模型来处理这些子目标的证明搜索,从而大大减轻了计算负担。

在训练过程中,团队精心筛选了一批难题,这些难题虽然 7B 模型无法直接解决,但其子目标已被证明。通过整合这些子目标的证明,团队形成了完整的形式化证明,并与 DeepSeek-V3 的推理过程对接,生成了丰富的合成数据。这些数据为模型的微调提供了坚实的基础。

随后,团队利用强化学习进一步提升模型的能力。他们以二元反馈(正确或错误)作为奖励机制,通过不断的试错和优化,使得 DeepSeek-Prover-V2-671B 在神经定理证明领域取得了显著进展。在 MiniF2F-test 数据集上,该模型的通过率达到了 88.9%,在 PutnamBench 数据集中也成功解决了 49 个问题。

为了推动模型在多样化场景下的测试与应用,DeepSeek 团队还发布了 ProverBench 基准数据集。该数据集包含了 325 个形式化数学问题,其中 15 个问题源自近期的 AIME 竞赛,涉及数论与代数等高中竞赛难度的内容。其余 310 个问题则涵盖了线性代数、微积分、概率等多个领域,为高中竞赛和本科数学提供了全面的评估标准。

中芯国际三季度业绩亮眼:月产能破百万,全年收入或创新高
赵海军指出,中国区收入的显著增长主要受益于国内产业链自主化进程加快,为应对客户紧急需求,公司及时优化了产能分配策略。赵海军补充表示,在当前国内企业加速替代海外供应链的背景下,公司长期合作的客户成功把握了市场机…

2025-11-14

高通跃龙IQ-X系列处理器登场 助力工业PC与边缘智能场景革新发展
高通技术公司汽车、工业及嵌入式物联网事业群总经理Nakul Duggal称,高通跃龙IQ-X系列将Qualcomm Oryon CPU的计算性能引入工业PC领域,有助于提升工厂车间边缘控制器的运行能力与…

2025-11-14

第45周国内手机市场格局:苹果领跑,小米vivo紧随其后竞争激烈
据CNMO了解,截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约395.7万台、iPhone17 Pro约246.2万台、标准版iPhone 17约172.8…

2025-11-14

W45周手机销量榜:苹果蝉联五周冠军,小米稳居国产首位,vivo紧随其后
每到周五可能大家都在等行业人士给出的最新一周国内智能手机领域排行榜,因为从周榜就可以分析出各品牌目前在国内生存状况。数据显示苹果还是国内排名第一的品牌,不过市场份额又滑落了一个百分点,这已经是苹果连续五周国内…

2025-11-14

疑似小米新款大尺寸横向阔折叠手机曝光 参数配置或迎重大升级
据CNMO了解,此前,有数码博主爆料称,小米新款大折叠手机正在测试2亿像素主摄,或采用1/1.4英寸大底高像素方案,可能支持35mm、50mm裁切光变。目前小米大折叠产品线型号为"MIX Fold",而新款…

2025-11-14

iQOO Neo11深度评测:骁龙8至尊版搭配Q2芯片,2K屏+7500mAh续航再掀性能风暴
去年的iQOO Neo10 依靠骁龙8 Gen3与1.5K屏,可谓是在2K价位段打出了一记漂亮的性能铁拳。在《王者荣耀》中,Neo11能稳定144Hz超满帧运行,帧率曲线几乎是一条直线。无论是《王者荣耀》1…

2025-11-13

一加Ace 6T新机曝光:骁龙8 Gen5加持,8000mAh大电池+超炫联名配色来袭
对此,在笔者看来,在高通骁龙8 Gen5芯片的加持下,一加Ace6T这款智能手机的综合性能是不用担心的,也即能够对标华为、小米、vivo、荣耀等厂商的中高端机型。 在续航上,爆料信息显示一加Ace 6T这款…

2025-11-13

荣耀GT2系列来袭:9000mAh大电池搭配骁龙强芯,性能续航双升级
【CNMO科技消息】11月12日,有数码博主爆料称,荣耀新款性能机GT2将搭载9000mAh超大电池和骁龙8至尊版移动平台。作为参考,现款荣耀GT Pro首批搭载了高通骁龙8至尊领先版移动平台,配合LPDD…

2025-11-12

vivo双11新机Y500 Pro来袭,2亿像素+7000mAh大电池,1799元起售
为了双11准备新手机是这几年手机行业中的惯例,这段时间手机厂商们发布的新机数量远超平时,而今年双11期间最忙碌的手机厂商是vivo,一般来说准备一款新机是常态,准备两款新机算是比较激进的,准备三款新机的就很稀…

2025-11-12