2025年11月,DeepSeek开源全新数学模型DeepSeekMath-V2,专注自验证数学推理,打破谷歌和OpenAI在该领域的垄断。该模型在IMO 2025、CMO 2024及Putnam 2024竞赛中表现卓越,尤其在Putnam中以118/120超越人类最高分90分,并在代数、几何、数论等CNML级别问题上全面领先GPT-5-Thinking-High和Gemini 2.5-Pro。DeepSeekMath-V2采用迭代强化学习循环优化证明生成与验证,首次实现完全自动化数据标注流程,显著提升模型能力。此模型由研究员邵智宏主导开发,他曾提出经典算法GRPO并参与多个重要项目。这一成果标志着开源AI在复杂数学推理领域的重要突破。
原文链接
本文链接:https://kx.umi6.com/article/29323.html
转载请注明文章出处
相关推荐
换一换
DeepSeek 推出 DeepSeekMath‑V2 模型,主打自验证数学推理能力
2025-11-27 20:52:29
DeepSeek 推出 DeepSeekMath‑V2 模型,主打自验证数学推理能力
2025-11-27 20:52:29
谷歌IMO金牌模型可以用了!推理性能秒了o3、Grok 4
2025-08-02 10:14:11
7天长不出头发赔1万元!一洗发水AI广告宣传涉嫌违法被投诉
2026-08-31 07:26:59
还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍
2026-09-02 15:35:06
神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光
2026-09-03 10:17:05
今年最难的机器人Demo,“机器人含量”为0
2026-09-03 10:15:24
磁带没死还活得好好的!AI催生160EB出货量:2026Q1同比暴增57%
2026-09-03 15:28:35
陈大年复出,入局大模型
2026-09-03 18:32:42
香港首个真实开放场景服务机器人落地兰桂坊
2026-09-02 10:25:57
ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律
2026-09-04 17:29:23
赛博朋克修车!网友用笔记本跑大模型查故障:不如200元买OBD
2026-09-02 19:47:51
AI本地部署不如官方版的元凶找到了:734个依赖包,每一个都可能坑
2026-08-29 22:20:53
752 文章
940591 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34