综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
8月26日至29日,HICOOL 2026全球创业者峰会在北京举行。中国专精特新企业飞渡科技凭借自研的空间智能“峥嵘大模型”斩获大赛一等奖。曾押中SpaceX的硅谷传奇投资人比尔·赖克特对其高度认可,并邀请其赴硅谷路演。当前AI正从语言理解向物理世界理解演进,世界模型成为AI下半场关键。与仅追求视觉生成的模型不同,飞渡科技打造的全栈空间智能基础设施已在城市防洪等真实场景中实现物理推演与智能决策,补齐了大模型通向物理世界的短板。产业与资本的双重认可,标志着世界模型的“中国时刻”已然开启。
原文链接
2026年9月,光象科技联合清华大学李升波教授课题组发布第一代物理原生世界模型Phi-WM 1.0 ActEffect。该模型打破常规,仅在训练阶段预测动作后果以优化策略,部署时即“退场”,大幅降低机器人运行的算力与时延成本。测试显示,其在LIBERO等仿真基准中成功率高达98.8%。此外,在2026ATC展会上,其Phi-Bot X1机器人已在蔚来汽车产线连续作业21.5小时零失误。该创新为具身智能在工业场景的低成本、高稳定规模化部署提供了全新解法。
原文链接
9月2日,李飞飞团队发布首个多模态世界模型Atlas,可通过图片重建3D场景并生成新视角。而中国团队“影溯”早在今年3月就已开源同款能力的InSpatio-World,还能处理时间维度构建4D场景!8月27日,影溯模型InSpatio-Curious凭借轨迹、深度等底层能力,登顶权威榜单WorldArena 2.0。8月29日,影溯更联合多方启动空间智能3D数据开放计划SIDO,拟建设百万级3D/4D数据底座。中国AI团队在世界模型赛道正展现出强劲的抢跑实力!
原文链接
日前,李飞飞与刚获IJCAI 2026计算机与思想奖的吴佳俊等学者在arXiv发布论文《TrAct》,提出新框架打破世界模型与机器人动作间的“巴别塔”。针对机器人低维“动作方言”与世界模型高维“像素画面”难以同频的痛点,TrAct引入“视觉轨迹”作“同声传译”。该框架含VLAT、TWM和VLAC三大模块,能精准预演画面,并复用海量无标签人类视频预训练。在严苛的LIBERO-INTEGRAL仿真及真机实验中,TrAct的跨本体泛化与成功率大幅领先基线模型,为具身智能提供了极具启发性的通用接口。
原文链接
李飞飞押注的“空间智能”,正推动AI从生成二维画面走向构建可进入、可操作的三维世界。然而,当前AI生成的世界往往“中看不中用”,根本原因是缺少一本“底账”——即记录对象身份、物理规则和变化历史的底层状态数据。
目前,构建可运行的三维世界面临两大瓶颈:一是“速度”,生成首个真正无错、可用的场景耗时极长...
原文链接
8月19日,世界机器人大会“物理AI引领者论坛”在北京举行。智象未来CEO梅涛发表演讲指出,AI正从“理解世界”迈向“改变世界”,高智商不等于全能。会上,智象未来正式发布基于自研架构的原生全模态交互式世界模型HiDream-O1-World。该模型登顶权威榜单WBench的Navi分榜,支持多模态输入,具备长时程时空与物理一致性,可广泛应用于AI互动影游、具身智能仿真及3D场景生成等领域。梅涛强调,世界模型是具身智能的认知中枢,未来将通过构建数据、模型、智能体与具身的闭环飞轮,助力物理AI迈入规模化与商业化新时代。
原文链接
2026年WRC大会上,无界动力与韩国HOLLYS联名打造的“沉浸式机器人咖啡店”成全场焦点。有别于传统隔离展示,该展台在真实开放环境中运营,机器人服务员与机械臂无需预设轨迹,即可自主完成手冲、送餐、收桌及消毒等复杂任务,展现卓越的动态感知与实时规划能力。这得益于无界动力研发的“隐空间世界模型”,其具身大脑MWA™已登顶国际权威榜单全球第一。目前,公司已获数亿美元融资及7亿元订单,通过“工业+商业”双线并行,成功构建具身智能商业化落地的完整证据链,让机器人真正在真实世界稳定创造价值。
原文链接
8月19日至23日,2026世界机器人大会(WRC)在北京举行。无界动力深度参与大会主论坛及多场同期活动,集中展示以隐空间世界模型为核心的具身通用大脑MWA™等自研成果。期间,“中国电子学会世界模型专家委员会”正式成立,无界动力CEO张玉峰受邀担任委员,并系统分享“隐空间世界模型+强化学习”技术路线。此外,无界动力高管团队还出席中韩机器人创新合作、商业化落地及工业试炼等主题活动,探讨全球产业协同与技术演进。公司强调,将以真实场景牵引模型持续进化,推动具身智能走向规模化落地,最终转化为现实生产力。
原文链接
近日,Noiz AI联合港科大、清华等机构正式发布实时可交互音视频世界模型HelixWorld 1.0,标志着世界模型迈入“有声时代”。该模型支持24FPS画面与48kHz立体声实时生成,填补了传统模型“有画无声”的短板。其核心突破在于声画由原生Transformer架构统一生成,能根据用户操作实时渲染动态场景与空间音效。通过构建多模态数据、因果化改造及蒸馏加速等技术,HelixWorld实现了从生成片段到持续实时运行的跨越。目前模型API已开启内测,权重与代码将在近几周内完全开源。未来团队还将探索多智能体交互等方向,有望重塑游戏与互动影视等应用场景。
原文链接
近日,由北大、清华、北航、上交大及中科大五大高校联合发起的TriWorldBench Challenge正式公布首周榜单。作为首个面向机器人三视角世界模型的评测榜单,其旨在推动世界模型从“视觉生成”迈向“世界理解”,重点评估多视角一致性、任务执行与物理空间理解能力。首周比赛中,WoVR_Plus、BetaBWM及Fysiverse-Video模型脱颖而出,位列前三。该榜单不仅提供排名,更作为“诊断工具”帮助团队精准优化模型。目前,评测已面向全球具身智能等相关研究团队开放报名,榜单将持续更新,共同探索具身世界模型的前沿发展。
原文链接
加载更多
暂无内容