近日,普林斯顿大学推出CEO-Bench测试,让14个AI模型在500天内运营本金100万美元的虚拟初创公司。结果惨烈,10家公司“破产”,仅3个大模型实现盈利。其中,Fable 5以4715万美元断层夺冠,Opus 4.8与GPT-5.5分列二三。令人意外的是,第四名竟是未使用大模型的纯规则算法,赚取1576万美元,击败众多知名模型。研究指出,商业决策中“探索大于谨慎”,且通用编程Agent并非万能,亟需垂直场景深度适配。尽管AI执行力强大,但制定核心战略的直觉仍属于人类。
原文链接
本文链接:https://kx.umi6.com/article/36743.html
转载请注明文章出处
相关推荐
换一换
全网疯传的Clawdbot,是下一个ChatGPT?
2026-01-29 11:21:36
豆包、千问与Kimi,站在AI Agent的岔路口
2026-01-21 08:59:27
字节、宇树、BAT等40+产品大咖齐聚,2026奇点智能产品大会最新最全日程来了!
2026-07-06 18:46:27
7 年 Google 老兵写出爆款工具被开除,转头官方发同款?OpenClaw 之父下场抢人
2026-06-25 11:14:57
阿里明日或将发布重要芯片产品
2026-03-23 12:14:04
一句「Make it better」,Fable 5 直接把贪吃蛇炼成「逆反人格」
2026-06-29 15:40:10
ChatGPT之父:若OpenAI不是第一家由AI执掌的公司 我将感到羞愧!
2025-11-06 10:54:45
一年连融三轮数亿元!字节+清华姚班,重构企业软件工程
2026-07-30 14:40:44
OpenClaw揭示AI智能体底层需求:人类的「拔线权」
2026-02-04 02:11:01
Agent刚拿到自己的邮箱和钱包 人类的收件箱已经挤爆了
2026-06-30 20:39:33
AI时代极致创业:3人公司9周内赚100万美元
2025-08-19 18:04:57
硅谷的AI加速精英 开始真正担心他们造出了天网
2026-07-29 18:03:41
“龙虾” 炸翻AI圈!雷军下场 鹅厂排长队
2026-03-07 00:48:20
697 文章
782955 浏览
24小时热文
更多
-
2026-08-14 00:44:54 -
2026-08-14 00:42:22 -
2026-08-13 21:37:36