2026年5月,李飞飞团队发布全新空间智能评测基准ESI-Bench,首次将观察者转变为行动者,闭合感知-行动回路。该基准包含10个任务类别、29个子类别及3081个实例,基于OmniGibson仿真平台构建,覆盖人类四大核心空间认知维度。研究发现,当前AI模型在主动探索和行动策略上存在明显短板,尤其在复杂场景中表现不佳。团队测试了GPT-5和Gemini等多模态大模型,结果显示感知能力较强,但行动决策能力几乎为零,且不完美的3D重建反而加剧问题。此外,模型还存在元认知缺陷,无法判断信息是否充分。论文由Yining Hong等人主导,李飞飞、吴佳俊等斯坦福教授参与,相关成果已公开于arXiv及项目官网。
原文链接
本文链接:https://kx.umi6.com/article/36115.html
转载请注明文章出处
相关推荐
换一换
李飞飞团队“50美元”复现DeepSeek R1真相:基座曝光
2025-02-07 09:55:00
李飞飞最新报告:中美顶级模型性能差距缩至0.3%
2025-04-10 09:46:25
“AI教母”李飞飞:世界是三维的,我们需要尊重这一事实
2024-12-13 12:21:08
李飞飞发布世界模型新成果:一个提示,生成无限3D世界
2025-09-17 10:25:51
“AI教母”李飞飞:世界是三维的,我们需要尊重这一事实
2024-12-13 12:21:08
李飞飞最新长文火爆硅谷
2025-11-11 11:01:00
空间智能卡脖子难题被杭州攻克!难倒GPT-5后,六小龙企业出手了
2025-08-28 11:17:24
独家|李飞飞团队“50美元”复刻DeepSeek的R1真相:基于阿里云Qwen模型监督微调而成
2025-02-06 20:43:09
3个月估值10亿,李飞飞空间智能首个模型诞生!一张图生成3D世界,视频游戏要变天
2024-12-04 19:45:40
群核科技升级空间智能战略,发布两款空间开源模型
2025-08-25 17:31:32
李飞飞最新长文火爆硅谷
2025-11-14 17:04:51
李飞飞自曝详细创业经历:五年前因眼睛受伤,坚定要做世界模型
2025-06-10 11:44:06
刚刚,李飞飞亲自下场定义世界模型
2026-06-04 09:56:31
799 文章
1007144 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47