近日,马斯克在社交平台X上发布一道数学题6÷2(1+2),声称答对者可获得特斯拉入职资格,引发网友热议。该题答案存在争议,有人认为是‘1’,有人认为是‘9’。斯坦福大学数学家塔沃克解释,按现代运算规则,答案为9;但1917年的规则可能得出答案1。IT之家测试了7款AI大模型,包括讯飞星火X1、DeepSeek R1、字节豆包1.5、文心X1 Turbo、腾讯混元T1、通义千问及OpenAI o3,发现讯飞星火X1和OpenAI o3表现最佳,均详细解释了争议点并给出正确答案9。整体来看,AI大模型在推理能力上进步明显,但仍存优化空间。
原文链接
本文链接:https://kx.umi6.com/article/17867.html
转载请注明文章出处
相关推荐
换一换
OpenAI推出首款搭载英伟达竞争对手Cerebras芯片的AI模型
2026-02-13 02:57:22
Meta 砸 143 亿美元投资 Scale AI 仅数月,双方合作关系出现裂痕
2025-08-31 10:00:15
新研究发现 AI 的最大破绽:不是不够聪明,而是不会“骂人”
2025-11-08 10:35:27
第一时间体验GPT-5,人人免费可用,马斯克表示不服
2025-08-08 06:03:18
刚刚,让谷歌翻身的Gemini 3,上线Flash版
2025-12-18 11:42:39
谷歌掀桌,一口气甩出16个AI王炸
2026-05-22 12:45:33
全球首款:浙大一院、阿里达摩院发布主动脉急诊 AI 模型,快速识别“最凶险胸痛”
2025-08-27 17:05:25
GPT-5发布了,到底有没有那么神?
2025-08-08 09:10:02
微软推出其首款自研 AI 模型:MAI-Voice-1 秒级生成音频,MAI-1-preview 剑指 Copilot 文本场景
2025-08-29 08:34:31
AI初创公司Sereact获1.1亿美元融资 旨在提升机器人适应性
2026-04-28 00:44:44
OpenRouter完成1.13亿美元B轮融资 投后估值达到13亿美元
2026-05-27 13:29:55
Meta最新AI模型推迟发布 性能表现不如同行
2026-03-13 16:30:15
德银:Anthropic不会是软件行业的“终结者”
2026-02-26 15:15:30
770 文章
959258 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47