1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

1月29日,阿里开源千问语音识别模型Qwen3-ASR系列,性能达开源最佳(SOTA),直逼顶级闭源模型。该模型支持52种语言与方言,可精准识别语速快的饶舌RAP歌曲,并在10秒内处理5小时音频。此次开源包括1.7B和0.6B两个版本,前者准确率极高,后者效率与性能平衡,适合端侧部署。Qwen3-ASR在中文、英文及方言识别上领先GPT-4o等闭源API,方言错误率比Doubao-ASR低20%。此外,阿里还开源了语音强制对齐模型Qwen3-ForcedAligner-0.6B及推理框架,加速产业落地。截至目前,阿里已开源400余个模型,千问家族全球下载超10亿,衍生模型超20万,采用率达53%,位居全球第一。

原文链接
本文链接:https://kx.umi6.com/article/32352.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
智谱开源GLM-OCR模型
2026-02-03 09:27:36
AI助手OpenClaw爆火:一个24小时不休息的数字管家
2026-02-01 00:05:18
力压Seedance 2.0! 神秘AI模型登全球AI评测榜第一名:正式宣布开源
2026-04-09 12:05:02
Transformer作者:DeepSeek才有搞头,OpenAI指望不上了
2025-09-12 11:09:05
荣耀推出智能体基础模型MagicAgent 面向全球开源
2026-03-03 16:20:21
腾讯混元世界模型 1.1 版本发布并开源:单卡即可部署,秒级创造 3D 世界
2025-10-22 18:50:23
连续发布两款万亿参数模型,蚂蚁 AI 来势汹汹
2025-10-11 16:31:47
阶跃StepAudio 2.5 ASR上线 支持500TPS极速推理
2026-04-24 14:19:56
腾讯混元开源翻译模型 1.5:手机 1GB 内存即可运行,效果超越商用 API
2025-12-30 16:27:33
阿里千问开源Qwen3-Coder-Next模型
2026-02-04 08:31:48
小米全面开源具身大模型MiMo-Embodied
2025-11-21 21:43:50
小米的首代机器人VLA大模型来了!丝滑赛德芙,推理延迟仅80ms丨全面开源
2026-02-12 21:45:01
蚂蚁灵波开源具身大模型LingBot-VLA,让机器人“看的更清楚 做的更明白”
2026-01-28 11:08:15
24小时热文
更多
扫一扫体验小程序