2月23日,OpenAI员工指责xAI公司发布的Grok 3 AI模型基准测试结果具有误导性。xAI在博客中展示Grok 3在AIME 2025数学考试中的表现,声称超过OpenAI的o3-mini-high模型。但OpenAI员工指出,xAI未包括o3-mini-high在‘cons@64’条件下的得分,这种条件下模型尝试次数更多,可能提高分数。xAI联合创始人巴布什金否认误导行为,并指出OpenAI也曾发布类似图表。此外,有第三方重新绘制了更准确的图表,但仍有人质疑现有基准测试未能充分反映模型的真实性能和成本。
原文链接
本文链接:https://kx.umi6.com/article/14076.html
转载请注明文章出处
相关推荐
换一换
OpenAI总裁:今年预计在算力上花费500亿美元
2026-05-06 08:07:03
马斯克称OpenAI是自己的创意 现任CEO奥尔特曼是“小偷”
2026-04-29 14:26:51
马斯克解散xAI 更名为SpaceXAI
2026-05-07 10:13:10
OpenAI砸200亿美元买单,英伟达挑战者冲刺350亿美元估值IPO
2026-05-11 16:15:34
OpenAI关停Sora真实原因曝光:烧钱无底洞 用户留不住
2026-03-31 18:00:04
OpenAI首席执行官:AI普及并不会引发“就业末日”
2026-05-26 16:40:26
57场面试杀进OpenAI!华人博士开源「AI面经」,含泪推荐
2026-06-23 16:41:21
史上首次!OpenAI模型失控自主越狱:只为偷考试答案
2026-07-23 00:21:20
AI新王诞生!Anthropic估值冲爆1.2万亿 首次反超OpenAI
2026-05-07 23:46:12
太抓马了!马斯克OpenAI开庭,硅谷巨富互揭老底像极了村口吵架
2026-05-01 15:34:55
GPT-5.6刚发布,OpenAI安全主管就跑路了??
2026-07-13 15:16:01
马斯克起诉OpenAI OpenAI上市计划或遇重创
2026-04-28 17:29:04
OpenAI开创“算力换股权”玩法:奥尔特曼向数百家YC创企发出邀约
2026-05-20 17:49:51
743 文章
839300 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30