1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

北京时间4月17日,OpenAI发布多模态推理大模型o3,自称性能超越行业对手。然而,研究机构Epoch AI的第三方测试显示,o3在FrontierMath上的得分仅为10%,远低于OpenAI此前宣称的25%。Epoch AI认为,双方测试差异可能源于评估框架、测试时间和数据集的不同。此外,ARC Prize Foundation称公开版o3经过优化,性能不及预发布版本。基准测试争议正成为AI行业常态,近期xAI和Meta的模型也面临类似质疑。

原文链接
本文链接:https://kx.umi6.com/article/17500.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
马斯克起诉OpenAI OpenAI上市计划或遇重创
2026-04-28 17:29:04
具身智能领域首个行业标准正式发布
2026-03-26 22:25:30
OpenAI拿下史上最大企业订单 三星12万员工全面接入ChatGPT
2026-06-22 12:42:17
降价50% OpenAI开打价格战:顶级套餐仅需100美元/月
2026-04-10 09:58:34
OpenAI,危机四伏
2026-04-27 10:03:03
不是吧OpenAI首款硬件吹半天就是个AI音箱??
2026-07-15 12:54:58
OpenAI大神教你如何榨干Codex
2026-05-23 18:54:39
OpenAI要求加利福尼亚州和特拉华州调查马斯克
2026-04-07 20:17:29
马斯克爆出「权力暗桩」,奥特曼进入反击时刻?
2026-05-12 15:18:46
哈?Q1狂烧250亿!OpenAI财报泄露全网炸锅
2026-06-18 13:25:35
不抢电、低耗水、还送免费Codex!OpenAI设法破解AI基建抵制
2026-07-24 00:12:30
刚刚,OpenAI首席未来学家离职!曾被马斯克骂蠢驴
2026-07-09 15:08:12
OpenAI被揭露惊天内幕:要挑拨大国竞争 像核技术那样发横财
2026-04-07 13:58:20
24小时热文
更多
扫一扫体验小程序