1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:让视频生成从「看起来真实」到「物理上正确」

正文:
当前视频生成技术常因缺乏物理规律理解而显得不真实。例如,蜂蜜倒入茶中可能突然断裂,冰块融化直接消失,玻璃球入水瞬间静止。这些问题源于模型依赖数据驱动的模式匹配,而非模拟真实过程。

四川大学雷印杰团队提出了一种新方法《Chain of Event-Centric Causal Thought for Physically Plausible Video Generation》,通过将复杂现象拆分为因果事件链,并结合物理规律约束,逐步生成视频内容。这种方法不仅追求画面真实,更注重变化过程符合现实逻辑,从而提升可信度和一致性。

实验显示,该方法在 PhyGenBench 数据集上取得 0.66 的得分,较此前最优方法提升 8.19%,相对基础模型提升超 30%。尤其在力学、光学、热学等场景中表现突出,物理顺序正确性显著增强。在 VideoPhy 数据集上,其语义与物理一致性达 49.3%,较最优方法提升 3.4%,流体相关场景提升超 10%。

消融实验表明,事件分解和关键帧生成模块对性能至关重要,去掉它们分别导致 11% 和 17% 的性能下降。此外,事件数量在 4 时达到最佳效果,过多或过少均影响性能。

研究流程包括文本理解、物理规律识别、事件链构建、关键帧生成及插值过渡。通过引入物理公式、因果结构建模和视觉锚点,模型从“生成合理结果”迈向“模拟真实过程”。

这一技术可广泛应用于短视频创作、教育演示、游戏开发及自动驾驶等领域,使生成内容更真实连贯。尽管在复杂多物理场景下仍有局限,但为未来研究指明方向。

通讯作者雷印杰为四川大学教授,长期从事人工智能研究,聚焦计算机视觉与多模态理解,主持多项国家级项目,推动学术与工程结合。

论文地址:https://arxiv.org/pdf/2603.09094

原文链接
本文链接:https://kx.umi6.com/article/34272.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
即梦AI网页版全面升级 打造一站式“AI片场”助力创意实现
2025-12-17 21:04:52
阿里万相视频生成大模型宣布开源:8.2GB 显存就能跑,测试超越 Sora
2025-02-25 23:11:59
30 秒让照片动起来,首个国产纯自研视频大模型 Vidu 上线
2024-08-01 18:28:17
腾讯图生视频全面开源,更懂物理规律,一手实测来了
2025-03-07 09:37:46
阿里通义万相 2.1 模型宣布升级:首次实现中文文字视频生成功能,支持无限长 1080P 视频的高效编解码
2025-01-10 11:16:50
视频生成平台 Runway 获得新技能:更改视频比例,图片拥有“电影级”运镜
2024-11-23 23:35:00
谷歌 Veo 2 视频生成模型入驻 Gemini,用户可创建 8 秒 720p 视频
2025-04-16 08:56:41
视频大模型“造梦机器”爆红:瑕疵真不少,关键是能用
2024-06-14 09:22:57
微软开源视频Tokenizer新SOTA!显著优于Cosmos Tokenizer和Open-Sora
2024-12-26 12:32:40
刚刚,全球视频模型新王诞生了!
2026-03-19 16:05:16
全栈AI基础设施支撑,跑出全球首个开放使用视频生成DiT模型
2025-04-28 11:46:30
Sora开服被挤爆!支持中文/编剧模式/作品分享,145块就能玩
2024-12-10 05:42:42
Seedance 2.0全面开放API服务
2026-04-14 15:06:59
24小时热文
更多
扫一扫体验小程序