陶哲轩,著名数学家,早在8月便试用了OpenAI o1的完整版,远早于公众。他在测试中发现,该模型能够成功识别克莱姆定理,并给出“完全令人满意的”答案,相较于之前的模型,整体性能提升明显,但在细节处理和创新方面仍有限。陶哲轩形象地将模型比喻为“平庸但有小能力的研究生”,指出若提供额外资源如代数软件,模型性能可显著增强。此次测试在HackerNews等平台引发热议。此外,陶哲轩通过三轮测试对比了ChatGPT与o1,显示后者在理解和解决问题时更为条理化,且能够找到合适的数学定理解决复杂问题。在数学研究层面,大模型的应用已渐趋日常化,如用户wenc分享,借助大模型能高效生成MIP公式,节省大量研究时间。陶哲轩表示,未来大模型在数学领域的应用有望更加广泛,但强调其价值取决于用户对提示词的运用技巧,而非模型本身。
原文链接
本文链接:https://kx.umi6.com/article/6399.html
转载请注明文章出处
相关推荐
换一换
陶哲轩吐槽GPT-6孪生素数新突破:令人无语的一幕
2026-09-05 13:13:13
陶哲轩亲测谷歌 Gemini 3:十分钟搞定百年数学难题
2025-11-23 23:27:24
一句废话就把OpenAI o1干崩了?大模型的推理能力还真挺脆弱的
2024-10-15 18:44:31
号称博士生水准!OpenAI最新模型仍分不出9.11和9.8哪个大
2024-09-15 18:12:45
陶哲轩:纳维-斯托克斯方程或已不再是流体的良好模型
2024-10-20 19:00:01
SAIR年度峰会即将开幕,陶哲轩等顶尖科学家共议AI如何重塑科研未来
2026-01-30 13:25:02
陶哲轩罕见长长长长长访谈:数学、AI和给年轻人的建议
2025-06-21 13:09:58
GPT-5又帮陶哲轩解决了一个难题
2025-09-03 15:46:53
陶哲轩亲测点赞o3-mini:专家级证明,我收到了一个完美的答案
2025-03-11 14:35:50
DeepSeek-R1 模型发布,性能对标 OpenAI o1 正式版
2025-01-20 22:24:20
OpenAI o1 全方位 SOTA 登顶 lmsys 排行榜:数学能力碾压 Claude 和谷歌 Gemini 模型,o1-mini 并列第一
2024-09-20 14:20:11
哈佛反向学习法火了:教会 AI 就是教会自己,陶哲轩力荐
2024-09-02 13:46:02
陶哲轩油管首秀:33分钟,AI速证「人类需要写满一页纸」的证明
2025-05-12 14:33:30
733 文章
897190 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47