12月24日,阿里通义发布Qwen3-TTS家族两款新模型:音色创造模型Qwen3-TTS-VD-Flash和音色克隆模型Qwen3-TTS-VC-Flash。前者支持通过自然语言指令精细调控音色、情感等,实现高度定制化声音生成,综合表现优于GPT-4o-mini-tts等竞品;后者可基于3秒音频实现多语种音色克隆,支持10种主流语言,平均词错误率(WER)领先MiniMax等模型。两款模型均具备高表现力拟人化音色与强大文本解析能力,适用于复杂文本处理和多样化场景需求。相关API文档已上线,为开发者提供便捷接入方式。
原文链接
本文链接:https://kx.umi6.com/article/30725.html
转载请注明文章出处
相关推荐
换一换
阿里通义百聆推出语音模型新版本:3 秒录音即可“复制”9 种语言、18 种方言
2025-12-15 16:47:57
阿里通义千问 Qwen3-TTS 语音合成 AI 模型发布:超 49 种音色,支持多种方言
2025-12-10 20:05:18
腾讯WorkBuddy联名硬件来了!首批100多家伙伴入场
2026-09-03 19:35:43
GPT-6 砍掉思考 Token,俄罗斯人砍掉通信 Token,Token 经济开始崩了?
2026-09-03 20:42:12
把AI塞满Windows!微软高管终于反思了
2026-09-02 10:28:48
李飞飞发布:全球首个多模态世界模型
2026-09-02 10:22:51
A社化身A割!Claude官宣永久提额25%,结果到手反而少17%
2026-09-01 16:44:57
在接下来70%的人生里 我可能都要问“是AI做的吗?”
2026-09-03 01:00:11
还在为大模型洗数据熬夜?蚂蚁拿下VLDB工业最佳论文,一套宽表搞定35PB语料,效率狂飙5.6倍
2026-09-02 15:35:06
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍
2026-09-01 18:52:06
陶哲轩吐槽GPT-6孪生素数新突破:令人无语的一幕
2026-09-05 13:13:13
赛博朋克修车!网友用笔记本跑大模型查故障:不如200元买OBD
2026-09-02 19:47:51
打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?
2026-09-04 19:40:20
790 文章
958989 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47