3月29日,清华大学人工智能研究院副院长、生数科技创始人朱军发布高可控视频大模型Vidu Q1,这是业内首个高可控AI视频大模型。Vidu Q1在多主体细节可控(动作、布局)、音效同步可控及画质增强方面表现突出。它能根据语义指令和参考图,精准调整多主体位置、大小、运动轨迹以及所有动作行为(如出场、退场、坐姿等)。此外,Vidu Q1具备音效同步功能,可根据视频环境生成并控制风声、雨声等音效的长短与时长节点,如0-2秒风声、3-5秒雨声。
原文链接
本文链接:https://kx.umi6.com/article/16405.html
转载请注明文章出处
相关推荐
换一换
阿里视频大模型Wan3.0开启公测:文档、ppt也能变视频
2026-08-07 12:21:41
“清华系Sora”全球上线,生成一段视频只需30秒,每月仅需58元
2024-07-31 18:20:02
生数科技再获数亿元大额融资,Vidu领跑多模态大模型赛道
2025-09-19 11:12:21
清华系智谱×生数达成战略合作,专注大模型联合创新
2025-04-27 15:19:08
中国第一,全球第二,视频大模型领军者生数科技完成超 6 亿元A+轮融资
2026-02-06 17:02:51
国产文生视频大模型 Vidu 将迎更新:支持生成 32 秒内容、音视频合成
2024-06-07 15:06:57
生数科技完成近20 亿元 B 轮融资,以通用世界模型定义下一代数字与物理世界生产力底座
2026-04-10 16:18:48
生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务
2026-04-30 09:05:54
AI模仿人类看漫画,视频大模型时序定位能力新SOTA
2024-11-23 12:23:27
“中国版Sora”视频大模型Vidu重大更新:时长延至32秒,首次支持音视频合成
2024-06-06 19:58:59
李飞飞、Yilun Du罕见联手:别给机器人建大脑了,直接偷视频模型的|GAIR Paper 115
2026-08-06 18:44:33
多模态AI创企生数科技再获数亿元融资 文生视频商业化进入加速期
2025-09-19 10:08:56
全球首发!Vidu 让任意主体保持一致,视频生成进入新阶段!
2024-09-12 15:51:26
775 文章
971803 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47