1月29日,阿里开源千问语音识别模型Qwen3-ASR系列,性能达开源最佳(SOTA),直逼顶级闭源模型。该模型支持52种语言与方言,可精准识别语速快的饶舌RAP歌曲,并在10秒内处理5小时音频。此次开源包括1.7B和0.6B两个版本,前者准确率极高,后者效率与性能平衡,适合端侧部署。Qwen3-ASR在中文、英文及方言识别上领先GPT-4o等闭源API,方言错误率比Doubao-ASR低20%。此外,阿里还开源了语音强制对齐模型Qwen3-ForcedAligner-0.6B及推理框架,加速产业落地。截至目前,阿里已开源400余个模型,千问家族全球下载超10亿,衍生模型超20万,采用率达53%,位居全球第一。
原文链接
本文链接:https://kx.umi6.com/article/32352.html
转载请注明文章出处
相关推荐
换一换
阶跃星辰开源GUI Agent技术和4B GUI Agent模型
2025-12-01 15:15:24
上传一张图、主演任何视频,“性能最强动作生成模型”阿里通义万相 Wan2.2-Animate 开源
2025-09-19 15:14:57
AI“以小博大”新标杆:三星开源 TRM 模型,700 万参数、特定任务性能媲美 Deepseek R1 等万倍大模型
2025-10-11 10:06:15
“会操作手机的 AI”,智谱开源 AI Agent 模型 AutoGLM
2025-12-09 10:29:51
英伟达开源 9B 参数 AI 小模型 Nemotron Nano v2,比 Qwen3 快 6 倍
2025-08-19 15:01:14
千问语音识别模型Qwen3-ASR开源!饶舌RAP歌曲也能轻松识别
2026-01-30 11:21:16
智谱 GLM-4.7-Flash 模型发布并开源,可免费调用
2026-01-20 09:47:20
三家混战,大模型重回2023
2025-08-03 11:35:50
北京人形开源最新VLM模型,推动具身智能再迈关键一步 !
2025-11-14 13:57:27
企业级OpenClaw最强拍档来了!万亿参数的国产多模态大模型,刚刚开源发布
2026-03-05 19:45:14
美国《连线》杂志:再见,GPT5;你好,千问!
2025-12-29 15:27:00
对话Kimi付强:别把模型当宠物圈养,追逐AGI就要让模型与人类共同演化
2025-10-04 10:57:38
阿里云通义千问开源 Qwen3-VL-30B-A3B 模型:智能体任务等领域媲美 GPT-5-Mini
2025-10-04 14:01:20
799 文章
568422 浏览
24小时热文
更多
-
2026-03-25 04:57:32 -
2026-03-25 00:39:03 -
2026-03-24 23:33:47