腾讯近日开源了混元语音数字人模型HunyuanVideo-Avatar,该模型由腾讯混元视频大模型及腾讯音乐天琴实验室技术联合研发。用户只需上传一张人物图像和一段音频,即可生成包含自然表情、唇形同步及全身动作的视频,支持头肩、半身与全身景别,以及多风格、多物种与双人场景。此模型适用于短视频创作、电商广告等多个领域,能有效降低制作成本。目前,单主体能力已开源,用户可通过腾讯混元官网体验,支持上传不超过14秒的音频生成视频,未来还将开放更多功能。开源地址及相关技术文档已同步发布。
原文链接
本文链接:https://kx.umi6.com/article/19389.html
转载请注明文章出处
相关推荐
换一换
腾讯开源最强3D生成模型,消费级显卡就能跑 | CVPR
2025-06-14 19:43:23
从海拉鲁到现实世界:视频模型如何理解「变化」
2026-09-30 16:56:59
60岁王祖贤借AI"复出" 坦言大家还讨论她19岁的样貌
2026-09-29 11:11:06
需求爆发CPU成了紧俏货!交付周期疯狂飙至30周
2026-09-29 12:15:58
Arm与NVIDIA携手为智能体AI时 代构建可信的计算底座
2026-09-29 16:30:14
GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元
2026-10-04 09:19:51
CPU交货期延长至25-30周 Muse究竟能引爆多大的需求潮
2026-09-29 19:43:38
OpenAI光速上新GPT-6.1 Sol!一晚上25项更新,都在这里了
2026-09-30 07:13:44
Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写
2026-10-01 10:43:13
偷走配音员声音判赔5万 上海首例AI语音合成侵权案宣判
2026-09-29 18:39:15
精准揪出RL训练数据Bug,Prompt直出小游戏,IQuest-Q1夯爆了!
2026-09-29 16:28:57
全球开源前二,阶跃终于回来了
2026-09-30 16:53:58
李飞飞创业公司被苏姿丰550亿收购!世界模型最大交易落地
2026-09-29 10:02:47
753 文章
968705 浏览
24小时热文
更多
-
2026-10-07 20:47:29 -
2026-10-07 17:37:56 -
2026-10-07 16:36:22