8月5日,谷歌DeepMind在Kaggle Game Arena平台举办“AI国际象棋”比赛,邀请OpenAI、Anthropic、谷歌等顶尖AI模型参赛。比赛为期三天,每日一轮,由国际象棋大师Hikaru Nakamura和流媒体播主Levy Rozman解说。首日战果显示,OpenAI的o4 mini胜Deepseek-R1,o3击败Kimi K2 Instruct,谷歌Gemini 2.5 Pro战胜Claude Opus 4,xAI的Grok4击败Gemini 2.5 Flash。比赛旨在测试顶级AI模型的推理、预见及策略调整能力,采用文本基础格式确保公平性。
原文链接
本文链接:https://kx.umi6.com/article/23079.html
转载请注明文章出处
相关推荐
换一换
Meta最新AI模型推迟发布 性能表现不如同行
2026-03-13 16:30:15
消息称 Meta 明年一季度发布全新 AI 模型 Avocado 牛油果,可能不会开源
2025-12-09 23:01:58
美国《连线》杂志:再见,GPT5;你好,千问!
2025-12-29 15:27:00
OpenAI 的“iPhone 时刻”:奥尔特曼称 GPT-5 是全球最佳写作、编程 AI 模型,免费 ChatGPT 用户也能体验
2025-08-08 03:00:19
谷歌最强 AI 模型 Gemini 3 正式登场:发布即登顶 LMArena,号称迄今最智能
2025-11-19 08:02:25
中门对狙,这下真的AI春晚了
2026-02-07 09:59:29
阿里达摩院推出肝癌AI模型,精准识别1厘米微小肿瘤
2026-08-24 16:48:06
亚马逊云科技发布 Nova 2 系列 AI 模型,同步推出 Nova Forge 定制服务
2025-12-03 09:12:53
最新研究:AI已经能在几分钟内通过CFA最难级别考试
2025-09-24 22:51:32
AGI又进一步了?谷歌AI模型重磅更新 助机器人感知环境完成复杂任务
2025-09-26 11:34:30
智谱冲击中国 AI 第一股,CEO 张鹏称模型销售年经常性收入已超 1 亿元
2025-12-02 19:30:45
OpenAI、Anthropic 互评对方 AI 模型:GPT 存在谄媚行为,Claude 不易产生幻觉
2025-08-28 10:18:59
马斯克xAI新模型上线,通过“50米外洗车店”测试,回答偏好高度贴合老马本人
2026-02-18 16:31:22
772 文章
962859 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47