2月23日,OpenAI员工指责xAI公司发布的Grok 3 AI模型基准测试结果具有误导性。xAI在博客中展示Grok 3在AIME 2025数学考试中的表现,声称超过OpenAI的o3-mini-high模型。但OpenAI员工指出,xAI未包括o3-mini-high在‘cons@64’条件下的得分,这种条件下模型尝试次数更多,可能提高分数。xAI联合创始人巴布什金否认误导行为,并指出OpenAI也曾发布类似图表。此外,有第三方重新绘制了更准确的图表,但仍有人质疑现有基准测试未能充分反映模型的真实性能和成本。
原文链接
本文链接:https://kx.umi6.com/article/14076.html
转载请注明文章出处
相关推荐
换一换
为了AI iPhone 苹果正式起诉OpenAI
2026-07-14 01:36:25
危!GPT-5.6会自动删文件,AI初创老板痛失整台Mac
2026-07-19 18:26:13
OpenAI,危机四伏
2026-04-27 10:03:03
赛博义父Tibo最新访谈:专门实体按钮搞重置,“我想重置就重置”
2026-08-25 13:34:45
像真人聊天!OpenAI发布GPT-Live:AI可同步听与说
2026-07-09 12:02:21
史上首次!OpenAI模型失控自主越狱:只为偷考试答案
2026-07-23 00:21:20
马斯克的xAI正加紧推动华尔街公司使用Grok聊天机器人
2026-05-14 04:17:16
OpenAI成立OpenAI部署公司 帮助企业构建人工智能系统
2026-05-11 21:30:47
OpenAI急眼了!四页密信怒撕Claude,80亿营收全掺水
2026-04-14 17:09:22
从哈佛辍学的前OpenAI研究员踏足AI制药,拿下20亿美元估值:VC在赌什么?
2026-07-17 17:44:20
OpenAI买几万台Mac搞强化训练!英伟达的活被苹果抢了
2026-08-31 11:38:31
诺和诺德宣布与OpenAI建立战略合作伙伴关系
2026-04-14 15:05:51
马斯克称OpenAI是自己的创意 现任CEO奥尔特曼是“小偷”
2026-04-29 14:26:51
750 文章
963060 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47