1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

你的模型真的会“举一反三”吗?RoboChallenge Table30 V2发布,泛化时代来临

具身智能正面临关键挑战:模型是否具备通用泛化能力,还是仅限于单一任务的过拟合?为解答这一问题,RoboChallenge正式推出Table30 V2,旨在通过“任务升级、评测升级和系统升级”三大维度,构建下一代具身智能的大规模真机泛化评测体系。

任务升级:应对真实世界的复杂性
Table30 V2新增18个双臂灵巧操作任务,与保留的12个经典任务共同组成30个高难度评估场景。这些任务涵盖软体物体(如绳索、布料)处理、工具使用与空间交互、双臂协作等复杂操作,挑战模型的空间推理、自适应控制及物理常识理解能力。此外,硬件平台引入新一代DOS-W1移动双臂系统,并兼容经典Aloha系统,验证模型在不同硬件配置下的鲁棒性。

评测升级:从单点突破到全维泛化
Table30 V2摒弃了单一任务优化模式,全面支持多任务模型评估,并引入零样本测试(Zero-shot),要求模型在未见过的物体、环境或动态变化中展现真正的理解力。同时,评测体系扩展至域外(Out-of-Domain)测试,通过改变桌面高度或替换背景等方式,探索模型的边界能力。

系统升级:效率提升300%
为加速科研迭代,Table30 V2大幅优化底层基础设施,吞吐量提升3倍,任务准备时间显著缩短。排行榜新增“完成时间”作为评分维度,推动研究者优化执行效率,而非单纯依赖推理时间换取成功率。

诚邀参与:RoboChallenge CVPR 2026竞赛启动
Table30 V2将作为CVPR 2026 Workshop竞赛预览版首秀,参赛者可在真实机器人集群上验证模型性能。竞赛结束后,评测平台将持续开放,助力全球研究者攀登具身智能的泛化高峰。

详情请关注:https://robochallenge.cn/competition

原文链接
本文链接:https://kx.umi6.com/article/34092.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
人形之外,擎羽把“身体”变成具身智能的新变量
2026-08-12 13:22:30
1.5B开源通用VLA模型,冲进具身智能第一梯队
2026-07-20 13:14:39
常州女首富机器人转型才开始,先因裁应届生上了热搜
2026-09-04 12:14:59
DeepSeek豪掷1.4亿护航宇树IPO,杭州绝代双骄战略合体
2026-08-07 09:09:17
世界模型“六小龙”在WAIC吵起来了!行业红利就在非共识里
2026-07-24 15:44:24
WRC 2026 风向标:具身智能下半场,比「大脑」更比「账本」
2026-08-22 20:20:42
这个世界模型训练完就“退场”,机器人反而更能干了
2026-09-05 13:11:38
具身大脑进了真实世界,难题才刚刚开始
2026-09-04 13:17:29
具身智能的「ChatGPT时刻」还没到,科沃斯先把机器人拆开了
2026-07-25 20:40:07
世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型
2026-07-28 13:59:31
苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
2026-07-19 15:24:53
空中具身操作:让蜘蛛侠们安全落地
2026-07-29 14:53:31
WRC乒乓球局爆火!这家中国具身创业公司,砸出了一套全栈新解法
2026-08-26 11:21:23
24小时热文
更多
扫一扫体验小程序