据《科创板日报》21日报道,OpenAI发现其最新推理模型o4在PersonQA测试中幻觉率较高。具体而言,o4有33%的问题回答出现幻觉,这一比例是之前模型o1和o3 mini的两倍;而o4 mini的表现更差,48%的问题存在幻觉现象。幻觉问题指AI生成的内容与事实不符或无根据。AI研究员Neil Chowdhury指出,o系列模型采用的强化学习可能加剧了这一问题。此情况引发关注,提示AI模型在优化过程中需平衡性能与准确性。
原文链接
本文链接:https://kx.umi6.com/article/17498.html
转载请注明文章出处
相关推荐
换一换
OpenAI被揭露惊天内幕:要挑拨大国竞争 像核技术那样发横财
2026-04-07 13:58:20
马斯克死磕奥特曼:赔款我不要,但他必须离开OpenAI董事会
2026-04-09 12:02:49
OpenAI发布Images 2 获机构Arena.ai测评第一
2026-04-22 16:21:00
欧盟委员会对OpenAI开放新型ChatGPT模型访问权限表示欢迎
2026-05-11 20:28:29
死敌爆料是狠!OpenAI内部信阴阳Claude营收注水80亿,然后泄露了…
2026-04-15 11:54:00
GPT-5.6突然发布!Fable5痛失最强基模王座
2026-06-27 10:51:01
投资人不买账 OpenAI估值8520亿美元遭质疑:战略转向引发争议
2026-04-15 06:41:58
Sora负责人离职
2026-04-18 07:48:11
OpenAI计划推出旗下首款硬件产品:移动式智能音箱 定位为AI陪伴助手
2026-07-15 07:45:44
OpenAI推动伊利诺伊州先进AI免责立法
2026-04-10 17:22:59
AI新王诞生!Anthropic估值冲爆1.2万亿 首次反超OpenAI
2026-05-07 23:46:12
57场面试杀进OpenAI!华人博士开源「AI面经」,含泪推荐
2026-06-23 16:41:21
OpenAI狂砸500亿美元算力预算 AI军备竞赛全面升级
2026-05-07 12:17:00
803 文章
845244 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30