1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

近日,马斯克在社交平台X上发布一道数学题6÷2(1+2),声称答对者可获得特斯拉入职资格,引发网友热议。该题答案存在争议,有人认为是‘1’,有人认为是‘9’。斯坦福大学数学家塔沃克解释,按现代运算规则,答案为9;但1917年的规则可能得出答案1。IT之家测试了7款AI大模型,包括讯飞星火X1、DeepSeek R1、字节豆包1.5、文心X1 Turbo、腾讯混元T1、通义千问及OpenAI o3,发现讯飞星火X1和OpenAI o3表现最佳,均详细解释了争议点并给出正确答案9。整体来看,AI大模型在推理能力上进步明显,但仍存优化空间。

原文链接
本文链接:https://kx.umi6.com/article/17867.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
骁龙X2 Elite NPU算力达80 TOPS 遥遥领先AMD/Intel!为何如此之高
2025-10-19 17:51:16
看完最新国产AI写的公众号文章,我慌了!
2025-12-08 21:48:04
Meta最新AI模型推迟发布 性能表现不如同行
2026-03-13 16:30:15
严防死守!美国AI三巨头封杀中国模型蒸馏
2026-04-07 18:11:07
马斯克的最快AI模型来了
2025-09-16 12:09:37
涨价浪潮下 DeepSeek推动AI“价格战”:百万Token输入0.25元
2026-04-26 10:07:20
智谱冲击中国 AI 第一股,CEO 张鹏称模型销售年经常性收入已超 1 亿元
2025-12-02 19:30:45
挑战英伟达:首个纯 AMD 硬件训练的 AI 大模型 ZAYA1 登场
2025-11-25 15:56:23
亚马逊云科技发布 Nova 2 系列 AI 模型,同步推出 Nova Forge 定制服务
2025-12-03 09:12:53
谷歌最强模型 Gemini 3.0 被曝 10 月 22 日登场:延迟、成本更低,编程等性能更强
2025-10-15 09:32:44
德银:Anthropic不会是软件行业的“终结者”
2026-02-26 15:15:30
看完最新国产AI写的公众号文章 我慌了
2025-12-10 18:05:25
Nano Banana 2 突然现身!能画公式解数学题,监控画面都能伪造
2025-11-10 16:25:59
24小时热文
更多
扫一扫体验小程序