给AI一张陶罐碎裂的图片,它能像侦探一样还原案发过程吗?近期,我们对比测试了开放权重的MiniMax H3与闭源模型Seedance 2.0 Fast。
实验中,我们输入一张动漫中陶罐碎裂的截图,并辅以“猫咪闯入撞碎陶罐”的文字提示,让AI反向生成事件视频。
本地部署的H3成功还原了“猫咪闯入、陶罐失衡、坠落碎裂”的完整因果链,且结尾的碎片特征与参考图高度一致。其核心在于多模态统一建模与音画联合生成。不过,H3的视频风格偏动画,猫咪撞击陶罐的关键细节不够清晰,且本地生成耗时约54分钟。
相比之下,闭源的2.0 Fast仅用3分多钟便完成生成。它的优势在于极强的写实质感和物理仿真能力,陶罐受力、翻落、碎裂的过程连贯且符合物理直觉,画面更具真实感。不过,视频中猫咪的动作略显刻意。
总结而言,H3的意义在于“开放探索”,让开发者能在本地研究因果反推与多模态生成;2.0 Fast则展现了闭源模型在速度、写实感和物理仿真上的成熟优势。当前,AI已具备将“结果图”扩展为“过程视频”的能力,但要完美复原真实的物理事故,仍需在动作因果和受力逻辑上继续突破。
原文链接
本文链接:https://kx.umi6.com/article/37694.html
转载请注明文章出处
相关推荐
换一换
OpenAI给不了的,DeepMind给,Sora联合负责人跳槽后开组新团队
2025-01-07 13:03:56
快手可灵 AI 上线 2.1 系列模型:不到 1 分钟生成 5 秒 1080p 视频,更快更便宜
2025-05-29 17:37:51
潞晨尤洋:视频生成的GPT-4时刻,3年后可以见证 | MEET 2025
2025-01-03 15:44:15
字节跳动 AI 助手豆包上线图片理解功能,上传图片即可“读图”
2024-12-04 08:33:01
刚刚,全球视频模型新王诞生了!
2026-03-19 16:05:16
新版Sora要来了?泄露视频引围观
2024-12-09 17:32:14
AI的下个进化和爆点
2024-07-29 09:23:23
视频大模型“造梦机器”爆红:瑕疵真不少,关键是能用
2024-06-14 09:22:57
还得是开源!潞晨Open-Sora技术路线公开,一键生成16秒720p视频
2024-06-18 14:10:52
腾讯版Sora发布即开源!130亿参数,模型权重、推理代码全开放
2024-12-03 16:22:39
豆包生视频功能升级 可同步生成声音和画面
2025-12-19 14:56:10
Sora二代实机演示曝光!解锁图生视频,奥特曼暗示:期待周一
2024-12-09 13:23:54
OpenAI正式推出AI视频生成模型Sora 会员无需额外付费
2024-12-10 04:42:31
800 文章
986458 浏览
24小时热文
更多
-
2026-09-01 16:59:26 -
2026-09-01 16:57:36 -
2026-09-01 16:55:58