Anthropic发布的Claude Sonnet 5上线仅一日便差评刷屏,核心争议在于“性价比全面翻车”。在硬核逻辑测试中,Sonnet 5的极限分数与Qwen、MiniMax等国产模型打平,但测试成本却高达后者的6倍以上。此外,其Max推理模式易陷入“过度思考”,导致Token消耗暴增,高昂账单已迫使Uber、微软等大厂重新评估或停用。同时,过度保守的安全对齐也使其丧失部分实用价值。尽管Sonnet 5在复杂Agent编程场景表现优异,但在日常推理中,开发者更倾向于选择成本极低的国产大模型。大模型赛道已正式从“拼智商”迈入“拼性价比”的时代。
原文链接
本文链接:https://kx.umi6.com/article/36811.html
转载请注明文章出处
相关推荐
换一换
上海AI实验室版o1已上线!数学题、Leetcode全拿下,还会玩24点
2024-11-28 15:29:46
谷歌最强模型 Gemini 2.5 Pro 发布即屠榜,创下史上最大分数飞跃纪录
2025-03-26 07:38:39
OpenAI“草莓”推理大模型两周内就要上架?用户恐将面临耐心考验
2024-09-11 03:18:27
GPT-4.1淘汰了4.5!全系列百万上下文,主打一个性价比
2025-04-15 10:24:50
GRPO在《时空谜题》中击败o1、o3-mini和R1
2025-03-27 16:59:27
谷歌大模型“性价比之王”来了
2025-04-18 12:12:29
国产大模型连续5周霸榜全球冠军
2026-03-22 15:57:12
GPT新版本猜想:奥特曼草莓图引发推理热潮
2024-09-06 12:03:27
苹果最新研究:现有 AI 大模型“更像是在记忆,而非真正的推理”
2025-06-08 17:10:55
“起大早赶晚集”的谷歌大模型,这次真的“遥遥领先”了?
2025-03-26 20:07:52
DeepSeek V3小版本大升级:推理、前端开发加强 这些能力超越GPT-4.5
2025-03-25 23:20:38
全网吹爆的大模型家电,真的值得种草吗?
2025-04-08 14:57:03
截胡 OpenAI:谷歌率先公测“奥数金牌级”推理 AI 模型 Gemini 3 Deep Think
2025-12-05 14:33:37
788 文章
921707 浏览
24小时热文
更多
-
2026-08-16 20:10:42 -
2026-08-16 19:11:09 -
2026-08-16 19:09:46