1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

你的模型真的会“举一反三”吗?RoboChallenge Table30 V2发布,泛化时代来临

具身智能正面临关键挑战:模型是否具备通用泛化能力,还是仅限于单一任务的过拟合?为解答这一问题,RoboChallenge正式推出Table30 V2,旨在通过“任务升级、评测升级和系统升级”三大维度,构建下一代具身智能的大规模真机泛化评测体系。

任务升级:应对真实世界的复杂性
Table30 V2新增18个双臂灵巧操作任务,与保留的12个经典任务共同组成30个高难度评估场景。这些任务涵盖软体物体(如绳索、布料)处理、工具使用与空间交互、双臂协作等复杂操作,挑战模型的空间推理、自适应控制及物理常识理解能力。此外,硬件平台引入新一代DOS-W1移动双臂系统,并兼容经典Aloha系统,验证模型在不同硬件配置下的鲁棒性。

评测升级:从单点突破到全维泛化
Table30 V2摒弃了单一任务优化模式,全面支持多任务模型评估,并引入零样本测试(Zero-shot),要求模型在未见过的物体、环境或动态变化中展现真正的理解力。同时,评测体系扩展至域外(Out-of-Domain)测试,通过改变桌面高度或替换背景等方式,探索模型的边界能力。

系统升级:效率提升300%
为加速科研迭代,Table30 V2大幅优化底层基础设施,吞吐量提升3倍,任务准备时间显著缩短。排行榜新增“完成时间”作为评分维度,推动研究者优化执行效率,而非单纯依赖推理时间换取成功率。

诚邀参与:RoboChallenge CVPR 2026竞赛启动
Table30 V2将作为CVPR 2026 Workshop竞赛预览版首秀,参赛者可在真实机器人集群上验证模型性能。竞赛结束后,评测平台将持续开放,助力全球研究者攀登具身智能的泛化高峰。

详情请关注:https://robochallenge.cn/competition

原文链接
本文链接:https://kx.umi6.com/article/34092.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
WAIC最狠展台打爆工业「深水区」!它石智航首发具身原生大脑AWE 3.5,具身Scaling全面释放
2026-07-23 11:42:41
华为“养”出半个具身智能创业圈
2026-05-18 17:47:47
华为具身大脑一号位创业,用认知科学造世界模型,获亿元级融资
2026-05-25 11:24:38
原华为云AI算法创新Lab主任朱森华创业 押注类脑智能与具身模型
2026-05-25 17:43:40
刚成立一年就拿下车厂订单,这家清华系公司把具身智能送进真实产线
2026-06-15 14:53:26
逛了趟WAIC,我只想说,AI在物理世界都快卷疯了……
2026-07-19 20:33:38
具身智能“高考”难疯了!人类100分,最强模型12.8
2026-07-08 21:28:09
酷哇科技亮相WAIC 2026,解密行业首个双层智能体世界模型
2026-07-22 10:50:23
英伟达开始搞机器人自己研究机器人那套了…
2026-06-20 20:23:27
国家队+千亿产业+头部财投集体入局,智平方200亿估值筑就大湾区具身智能名片
2026-06-29 16:40:25
让机器人行动更有依据:复旦等提出 GuidedVLA,提升 VLA 可控可解释能力
2026-06-08 11:27:33
招募|量子位RSS’26专题策划
2026-07-04 05:34:24
全球首个机器人训练楼盘开盘:30万套中国住宅,机器人拎包入住
2026-06-05 15:01:09
24小时热文
更多
扫一扫体验小程序