4月19日消息,OpenAI最新推出的o3和o4-mini推理模型虽在编程与数学任务上表现优异,但被曝出“幻觉”问题更为严重。TechCrunch报道显示,这些模型的幻觉率不仅高于前代o1、o1-mini和o3-mini,甚至超过传统非推理模型。内部测试中,o3的幻觉率达33%,而o4-mini更高至48%。第三方机构Transluce发现,o3会虚构操作过程,如声称在MacBook Pro上运行代码。OpenAI承认幻觉问题是行业难题,需进一步研究,发言人Niko Felix表示正努力提升模型准确性。
原文链接
本文链接:https://kx.umi6.com/article/17452.html
转载请注明文章出处
相关推荐
换一换
不抢电、低耗水、还送免费Codex!OpenAI设法破解AI基建抵制
2026-07-24 00:12:30
OpenAI疯狂挖苹果墙角 苹果砸重金留人防跳槽
2026-03-27 20:18:27
一句「哈哈」引发的苹果OpenAI窃密大战
2026-07-16 13:42:09
Sora负责人离职
2026-04-18 07:48:11
OpenAI被曝将大规模招聘 到2026年底员工总数或达8000人
2026-03-22 17:00:26
马斯克称OpenAI是自己的创意 现任CEO奥尔特曼是“小偷”
2026-04-29 14:26:51
福布斯发布2026年AI50榜单:OpenAI、Anthropic领衔 20家公司新上榜
2026-04-21 19:20:40
全球算力告急!OpenAI豪掷1450亿疯狂囤算力
2026-04-17 18:16:48
Ilya曝光70页OpenAI绝密文件
2026-04-07 10:47:37
OpenAI收购了一家脱口秀公司
2026-04-03 18:13:08
独家专访|苏炜杰加入OpenAI:Scaling Law撞墙后为什么需要数学家出手?
2026-06-29 15:36:01
OpenAI落子新加坡 首设海外人工智能实验室
2026-05-20 15:45:11
57场面试杀进OpenAI!华人博士开源「AI面经」,含泪推荐
2026-06-23 16:41:21
777 文章
821197 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30