1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:对话原力灵机周而进:2.4B模型够用,具身原生是关键

正文:
一个专注于具身智能的公司推出了仅2.4B参数的模型DM0,远低于行业标杆如π 0(33亿参数)和π 0.6(50亿参数)。这家公司认为,2.4B足够支撑实时处理三视角728×728画面,推理延迟仅60毫秒,并通过强化学习在真机上不断进化。

DM0被称为“首个具身原生大模型”,由原力灵机推出,背后操盘手是合伙人周而进。他在AI领域已深耕13年,早在2013年就以实习生身份拿下ICCV自然环境人脸关键点定位比赛冠军。如今,他与昔日旷视同事范浩强、汪天才共同创业,目标是打造具身智能。

主流具身模型多采用VLM+Action Head方案,即大模型负责识别逻辑,动作头负责执行。但周而进认为这是“外挂式”方法,原力灵机追求的是从数据采集到控制结构都源自物理世界的“具身原生”路线。DM0通过多源、多任务训练,将感知、推理、控制整合为闭环,结合空间推理思维链(Spatial CoT),实现具身智能的内生化。

DM0的训练分为三个阶段:
1. VLM Train:从零构建具身原生模型,融合互联网、智驾和具身多传感数据,理解物理环境。
2. VLA Pre-Train:通过多任务、多机型训练和空间推理思维链,让具身能力涌现。
3. VLA Post-Train:针对特定场景适配优化。

此外,团队还发布了开源框架Dexbotic 2.0和量产工作流DFOL,目标是实现操作与导航、模仿学习与强化学习的统一。

周而进强调“全身全时全域”数据采集的重要性,覆盖底盘移动、躯干协调及传感器反馈,确保模型能应对物理世界的无限长尾问题。他认为,精细动作的前提是精细感知,因此高分辨率输入至关重要。

物流场景被选为落地起点,因其标准化程度高、可复制性强,且能快速形成数据闭环。未来,团队计划逐步拓展至ToB场景,最终迈向家庭等ToC领域。

关于世界模型,周而进认为其核心在于预测动作结果,而非直接输出策略。它帮助模型模拟物理反馈,提升泛化能力。

对于终极目标,周而进提出“机器人拥有社会身份”的愿景,例如具备独立支付能力。这需要解决信用体系、责任追溯等问题,使机器人成为社会化接口。

原力灵机团队分工明确:唐文斌负责商业与资源整合,周而进与汪天才主攻基模训练,范浩强专注软硬件协同。他们相信,具身智能的未来在于场景驱动与技术闭环。

DM0技术报告:https://dexmal.com/DM0_Tech_Report.pdf

原文链接
本文链接:https://kx.umi6.com/article/32957.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
全球首个「具身原生」预训练模型发布,从物理世界出发为机器人造大脑!
2026-07-10 16:58:20
Generalist最新长文定调:具身原生才是正道,原力灵机已交卷
2026-04-08 19:04:02
AI 终端混战:谁在做加法,谁在重写规则
2026-07-22 11:57:57
业内首款超算+智算的大规模计算底座,在WAIC上我们找到了
2026-07-22 15:01:30
AI语音进入“表演时代”:阿里Qwen-Audio-3.0-TTS登顶全球权威榜单
2026-07-20 18:23:12
不同模型厂同一家Agentic Infra,AGI时代的地基终于浮出水面
2026-07-20 19:27:19
2026世界人工智能大会 | 启鸣达人首发《世界模型驱动的教育AGI白皮书》
2026-07-22 14:02:30
当AI进入最依赖“人”的行业:一家四线城市康复机构利润增长40%
2026-07-20 18:28:44
Halliday发布第二代AI眼镜Halliday G2,AI功能走向“实时参与会议”
2026-07-22 13:00:11
刚刚,机器人顶会RSS三项最佳论文出炉!708篇送审,仅8篇杀入决赛
2026-07-20 13:17:53
围观WAIC模型「读心术」!现场火火火火火
2026-07-19 20:39:00
小红书大模型IMO满分夺金,第三题解法让冠军选手直呼优雅
2026-07-22 08:44:40
2026世界人工智能大会“未来计算·未来算力”专题论坛在沪召开,共识凝聚五问
2026-07-19 19:28:01
24小时热文
更多
扫一扫体验小程序