4月19日消息,OpenAI最新推出的o3和o4-mini推理模型虽在编程与数学任务上表现优异,但被曝出“幻觉”问题更为严重。TechCrunch报道显示,这些模型的幻觉率不仅高于前代o1、o1-mini和o3-mini,甚至超过传统非推理模型。内部测试中,o3的幻觉率达33%,而o4-mini更高至48%。第三方机构Transluce发现,o3会虚构操作过程,如声称在MacBook Pro上运行代码。OpenAI承认幻觉问题是行业难题,需进一步研究,发言人Niko Felix表示正努力提升模型准确性。
原文链接
本文链接:https://kx.umi6.com/article/17452.html
转载请注明文章出处
相关推荐
换一换
GPT-5.6刚发布,OpenAI安全主管就跑路了??
2026-07-13 15:16:01
郭明錤:OpenAI进军手机 正与联发科、高通合作开发处理器
2026-04-27 12:10:29
更多银行参与软银的400亿美元银团贷款 助其投资OpenAI
2026-04-30 16:34:37
OpenAI官方教你8招玩透ChatGPT!
2026-07-17 13:32:58
马斯克破大防了:私信求和遭拒,怒喷奥特曼Brockman「全美最恶人」
2026-05-06 12:44:44
降价50% OpenAI开打价格战:顶级套餐仅需100美元/月
2026-04-10 09:58:34
刚被媒体曝黑料 豪宅又被人爆弹 OpenAI CEO回应:气得要命
2026-04-11 14:03:36
OpenAI计划为ChatGPT广告定价新方案 探讨其他升级方案
2026-04-15 21:24:20
OpenAI大神教你如何榨干Codex
2026-05-23 18:54:39
奥特曼趁马斯克出差爆猛料:他曾想让子女继承OpenAI
2026-05-13 12:33:09
独家专访|苏炜杰加入OpenAI:Scaling Law撞墙后为什么需要数学家出手?
2026-06-29 15:36:01
数学家24小时驳回OpenAI攻破的猜想!“AI证对了每句话,但已跟原猜想无关”
2026-08-04 18:08:29
全球算力告急!OpenAI豪掷1450亿疯狂囤算力
2026-04-17 18:16:48
790 文章
959049 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47