DeepSeek 推出 DeepSeekMath‑V2 模型,主打自验证数学推理能力

2025-11-28 16:53:54   |   棠糖   |   1327

11月28日,DeepSeek 发布了 DeepSeekMath‑V2,主打可自我验证的数学推理训练框架。

团队认为,仅追求最终答案正确率难以保证推理链条的严谨性,尤其在定理证明等需要逐步推导的任务中更为突出。模型通过构建基于 LLM 的验证器,对生成的证明进行自动审查,并利用扩展的验证计算持续生成高难度训练样本提升验证器能力。

据报道,DeepSeekMath‑V2 基于 DeepSeek‑V3.2‑Exp‑Base,在 2025 年国际数学奥林匹克竞赛(IMO 2025)与 2024 年中国数学奥林匹克竞赛(CMO 2024)中均达到金牌水准,并在 2024 年普特南数学竞赛(Putnam 2024)中取得 118/120(近乎满分)的优异成绩。官方称,尽管尚有大量工作待推进,当前成果已表明:可自验证的数学推理是一条切实可行的研究路径,有望为构建更强大、更可靠的数学智能系统奠定基础。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

DeepSeek 推出 DeepSeekMath‑V2 模型,主打自验证数学推理能力

2025-11-28 16:53:54 浏览量: 1327 作者: 棠糖

11月28日,DeepSeek 发布了 DeepSeekMath‑V2,主打可自我验证的数学推理训练框架。

团队认为,仅追求最终答案正确率难以保证推理链条的严谨性,尤其在定理证明等需要逐步推导的任务中更为突出。模型通过构建基于 LLM 的验证器,对生成的证明进行自动审查,并利用扩展的验证计算持续生成高难度训练样本提升验证器能力。

据报道,DeepSeekMath‑V2 基于 DeepSeek‑V3.2‑Exp‑Base,在 2025 年国际数学奥林匹克竞赛(IMO 2025)与 2024 年中国数学奥林匹克竞赛(CMO 2024)中均达到金牌水准,并在 2024 年普特南数学竞赛(Putnam 2024)中取得 118/120(近乎满分)的优异成绩。官方称,尽管尚有大量工作待推进,当前成果已表明:可自验证的数学推理是一条切实可行的研究路径,有望为构建更强大、更可靠的数学智能系统奠定基础。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号