1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:让视频生成从「看起来真实」到「物理上正确」

正文:
当前视频生成技术常因缺乏物理规律理解而显得不真实。例如,蜂蜜倒入茶中可能突然断裂,冰块融化直接消失,玻璃球入水瞬间静止。这些问题源于模型依赖数据驱动的模式匹配,而非模拟真实过程。

四川大学雷印杰团队提出了一种新方法《Chain of Event-Centric Causal Thought for Physically Plausible Video Generation》,通过将复杂现象拆分为因果事件链,并结合物理规律约束,逐步生成视频内容。这种方法不仅追求画面真实,更注重变化过程符合现实逻辑,从而提升可信度和一致性。

实验显示,该方法在 PhyGenBench 数据集上取得 0.66 的得分,较此前最优方法提升 8.19%,相对基础模型提升超 30%。尤其在力学、光学、热学等场景中表现突出,物理顺序正确性显著增强。在 VideoPhy 数据集上,其语义与物理一致性达 49.3%,较最优方法提升 3.4%,流体相关场景提升超 10%。

消融实验表明,事件分解和关键帧生成模块对性能至关重要,去掉它们分别导致 11% 和 17% 的性能下降。此外,事件数量在 4 时达到最佳效果,过多或过少均影响性能。

研究流程包括文本理解、物理规律识别、事件链构建、关键帧生成及插值过渡。通过引入物理公式、因果结构建模和视觉锚点,模型从“生成合理结果”迈向“模拟真实过程”。

这一技术可广泛应用于短视频创作、教育演示、游戏开发及自动驾驶等领域,使生成内容更真实连贯。尽管在复杂多物理场景下仍有局限,但为未来研究指明方向。

通讯作者雷印杰为四川大学教授,长期从事人工智能研究,聚焦计算机视觉与多模态理解,主持多项国家级项目,推动学术与工程结合。

论文地址:https://arxiv.org/pdf/2603.09094

原文链接
本文链接:https://kx.umi6.com/article/34272.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
首次实现中文文字生成,消息称阿里通义万相 2.1 视频生成模型今晚开源
2025-02-25 18:03:21
对比Sora与国产视频模型生成效果后,我对Sora祛魅了
2024-12-20 11:26:51
第一批不找工作的年轻人,靠AI半年赚30万
2024-10-16 10:22:27
继HappyHorse后,阿里又有一款模型登顶权威评测榜单
2026-04-16 11:55:19
OpenAI发布最新视频模型Sora Turbo,会员免费用,网站被挤爆
2024-12-10 10:51:02
OpenAI Sora 应用限时开放:美、加、日、韩用户无需邀请码即可进入
2025-11-02 15:28:45
爱诗科技完成3亿美元C轮融资,鼎晖领投,开启“实时交互”视频生成新纪元
2026-03-12 15:44:44
给 AI 一张陶罐碎片图,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测
2026-09-01 16:52:42
何必DiT!字节首次拿着自回归,单GPU一分钟生成5秒720p视频 | NeurIPS’25 Oral
2025-11-14 13:59:52
免训练加速DiT!Meta提出自适应缓存新方法,视频生成快2.6倍
2024-11-08 09:15:04
全栈AI基础设施支撑,跑出全球首个开放使用视频生成DiT模型
2025-04-28 11:46:30
实测Claude 3.7:3200行代码一口气输出,物理规律手拿把掐,弱智吧已失守
2025-02-25 15:58:40
Sora二代实机演示曝光!解锁图生视频,奥特曼暗示:期待周一
2024-12-09 13:23:54
24小时热文
更多
扫一扫体验小程序