7月20日,阿里巴巴正式发布语音合成大模型Qwen-Audio-3.0-TTS,包含Flash与Plus两个版本,其中Plus版已成功登顶全球第三方权威榜单Artificial Analysis。该模型标志着AI语音进入“表演时代”,不仅支持细粒度情绪标签控制,能精准演绎轻笑、愤怒等声音细节,还全面覆盖16种语言与20种方言,在多语种评测中斩获多项第一。此外,模型具备高噪环境抗噪克隆能力,音质提升至48kHz录音棚级标准。即日起,两款模型已在阿里云百炼平台开放调用。
原文链接
本文链接:https://kx.umi6.com/article/37094.html
转载请注明文章出处
相关推荐
换一换
奥斯卡获奖演员麦康纳、凯恩与 ElevenLabs 签约,为 AI“献声”
2025-11-12 18:17:54
Soul App开源播客语音合成模型,可流畅自然多轮语音对话,支持川粤豫等多方言与副语言风格
2025-10-29 16:58:57
脑机接口技术迎来重大突破:可使渐冻症患者重新流畅说话、唱歌
2025-06-16 09:05:32
独立游戏工作室 Serene Questworks 用 AI 篡改真人语音,配音演员愤而起诉
2025-03-12 17:34:53
“AI体育主播”上岗 将模拟已故解说员报道NBA赛事
2025-05-07 21:17:07
雷军,可能有点心烦...
2024-10-11 16:09:18
AI语音厂商思必驰完成5亿元融资
2025-01-14 10:10:31
智谱上线并开源文本转语音模型 GLM-TTS:只需 3 秒语音样本即可克隆声音
2025-12-11 10:42:18
MiniMax登顶、多家创企融资,AI语音离「现实场景」还有多远?
2025-06-06 12:28:01
超越OpenAI、拿下全球双料第一,“AI吴彦祖”背后大模型SOTA了!
2025-05-16 17:26:17
小米集团AI实验室发布ZipVoice系列语音合成(TTS)模型
2025-09-12 11:11:52
阿里通义千问 Qwen3-TTS 语音合成 AI 模型发布:超 49 种音色,支持多种方言
2025-12-10 20:05:18
AI语音首次达到人类水平 科学家:太过危险 无法向公众发布
2024-07-12 13:44:01
718 文章
795829 浏览
24小时热文
更多
-
2026-07-21 06:51:16 -
2026-07-20 23:38:15 -
2026-07-20 19:29:25