综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
7月10日,蚂蚁灵波正式发布行业首个具身原生世界动作模型LingBot-VA 2.0,这标志着机器人基础模型正式向“面向物理世界原生设计”的关键转变。该模型摒弃了传统的微调路线,基于自回归架构从头预训练,融合语义视觉-动作分词器、MoE架构等四大核心设计,成功实现单卡150Hz的实时推理效率。在真机测试中,机器人可不依赖外部设备与人类完成多轮随机对打,展现出出色的执行速度与泛化能力。此外,蚂蚁灵波将于7月17日至20日在上海举办的2026世界人工智能大会(WAIC)期间,全面展示全栈大脑2.0落地场景的能力。
原文链接
7月9日,蚂蚁灵波科技开源新一代实时交互世界模型LingBot-World 2.0。该模型在业界首次实现“小时级”实时生成,一小时不间断测试中画面清晰连贯;支持720p/60fps高清输出,边生成边显示,操控近乎无延迟。同时,它在业界首次引入双Agent机制,支持攻击、施法等丰富动作与天气变化等事件触发,并开创性支持AI原生多人同世界交互。该模型将赋能游戏生成、影视预演及具身智能训练等场景。用户现已可通过Reactor平台和灵光APP在线体验。
原文链接
7月8日,蚂蚁灵波科技正式升级并开源新一代具身基座模型LingBot-VLA 2.0。该模型在预训练阶段融入6万小时高质量真实物理数据,全面支持乐聚、智元等17家主流厂商的20种机器人构型,并扩展了对头部、腰部及移动底盘等自由度的支持。多项评测显示,LingBot-VLA 2.0在双臂协同与长程移动操作任务中的综合性能显著领先于π0.5等模型,且推理耗时在RTX4090上控制在130毫秒内。目前,蚂蚁灵波已携手生态伙伴在零售、物流及工业等场景开启商业落地测试。开发者现可通过Hugging Face、魔搭社区及GitHub获取模型与代码。
原文链接
4月27日,蚂蚁集团旗下灵光App推出“体验世界模型”功能,用户上传图片即可生成60秒的3D世界,以第一人称视角实时漫游。这一功能基于蚂蚁灵波开源的世界模型LingBot-World-Fast,可在480P分辨率下实现16fps实时生成,延迟控制在1秒内,兼具通用性与动态场景表现力。开发者可通过开源代码进行本地部署和二次开发,支持键盘、鼠标操控视角及文本提示调整环境。该模型通过优化方案提升生成效率,适用于具身智能研发、游戏开发和内容创作。今年1月,蚂蚁灵波曾开源LingBot-World-Base版本,获广泛关注。目前,LingBot-World-Fast已完整开放于Hugging Face和Model Scope平台。
原文链接
1月30日,蚂蚁灵波科技宣布开源具身世界模型LingBot-VA。该模型首次提出自回归视频-动作世界建模框架,将大规模视频生成与机器人控制深度融合。LingBot-VA能够在生成“下一步世界状态”的同时,直接推演并输出对应的动作序列,使机器人实现“边推演、边行动”的类人能力。这一技术突破为机器人领域带来全新可能性,进一步推动具身智能的发展。
原文链接
2026年1月,蚂蚁灵波团队开源了具身智能基座模型LingBot-VLA,基于20000小时真实世界机器人数据训练,成为当前最强的Vision-Language-Action(VLA)模型。该模型在权威评测GM-100基准中全面超越π0.5、英伟达GR00T N1.6等顶尖模型,尤其在复杂任务如收纳、餐具清洁中表现出色。LingBot-VLA采用专家混合Transformer架构与流匹配技术,具备跨机器人平台的泛化能力,并首次系统验证了真实数据规模与性能提升的Scaling Law。蚂蚁灵波专注为机器人提供‘通用大脑’,通过开源代码、评估基准及高效训练方案,推动行业从实验室迈向规模化落地。项目主页和代码已公开,展示了蚂蚁集团在AGI领域的技术布局与开放愿景。
原文链接
加载更多
暂无内容