8月26日,阿里云宣布开源全新多模态视频生成模型通义万相 Wan2.2-S2V。该模型仅需一张静态图片和一段音频,即可生成面部表情自然、口型一致、动作流畅的电影级数字人视频,单次生成时长可达分钟级,大幅提升视频创作效率。模型支持真人、卡通、动物等多类型图片及肖像、半身、全身画幅,还可通过文本控制丰富视频内容。例如,上传人物弹钢琴照片、歌曲和文字,可生成高质量演奏视频,手指动作与音频节奏完美匹配。技术上,Wan2.2-S2V融合音频驱动和文本引导机制,采用层次化帧压缩技术实现稳定长视频生成,训练数据集超60万个音视频片段。实测显示其在FID、EFID、CSIM等指标上领先同类模型。自今年2月以来,通义万相已开源多款模型,下载量超2000万。
原文链接
本文链接:https://kx.umi6.com/article/24239.html
转载请注明文章出处
相关推荐
换一换
阿里开源视频生成模型Wan2.2-S2V
2025-08-26 22:55:59
上传一张图、主演任何视频,“性能最强动作生成模型”阿里通义万相 Wan2.2-Animate 开源
2025-09-19 15:14:57
视频生成界的大瓜:Runway 组织公司全员,把互联网扒了个干干净净
2024-07-26 23:07:39
阿里巴巴开源视频生成模型通义万相 Wan2.2,首创电影美学控制系统
2025-07-28 21:19:42
蚂蚁灵波开源LingBot-Video,全球首个面向具身的视频基模来了!
2026-07-09 11:58:53
快手抖音争相上桌,AI短剧何以成为香饽饽?
2024-07-17 20:29:10
美团视频生成模型来了!一出手就是开源SOTA
2025-10-27 16:06:12
比肩Sora!视频模型王者Gen-3回归,能表现人类复杂感情,但不理解物理世界
2024-07-03 23:17:00
阿里发布通义 Wan2.2-I2V-Flash 模型:推理速度比 Wan2.1 提升 12 倍,图生视频更轻快
2025-08-11 16:07:50
阿里发布视频生成模型HappyHorse 1.1:五大维度全面升级
2026-06-22 15:48:30
Runway 发布第三代视频生成模型,90 秒生成 10 秒片段
2024-06-18 11:29:52
AI恐怖体操视频腿脚乱飞、大变活人,LeCun:视频生成模型根本不懂物理
2024-07-01 18:07:59
字节视频生成模型PixelDance上线即梦AI:用户可免费体验
2024-11-16 00:11:12
778 文章
958148 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34