9月24日,阿里巴巴发布全模态预训练大模型Qwen3-Omni系列。该模型在36个音视频基准测试中,22项达SOTA水平,32项取得开源模型最佳效果,语音识别、音频理解与对话能力媲美Gemini2.5-Pro。Qwen3-Omni支持全模态输入输出,通过多模态混合训练实现“听”“说”“写”能力,预训练采用单模态与跨模态数据结合。其在音频、音视频能力突出的同时,文本与图像性能保持稳定,首次实现业内这一综合训练效果。
原文链接
本文链接:https://kx.umi6.com/article/25792.html
转载请注明文章出处
相关推荐
换一换
DeepSeek等开源模型,更“浪费”token吗?
2025-10-11 10:17:13
从 OpenClaw 们自掏腰包补贴,看中国模型又一个全球时刻
2026-02-03 02:12:36
国产玩家亮剑世界模型!把全模态卷到顶后,天工AI不藏了
2026-03-27 22:20:52
美国“SPAC之王”查马斯:公司已转用Kimi K2
2025-10-11 19:32:28
OpenAI 推出两款开源模型 gpt-oss-120b / 20b,性能逼近 o4-mini/o3-mini
2025-08-06 08:23:05
最强Coding Plan上线!阿里云上线Qwen3.5、GLM-5、MiniMax M2.5、Kimi K2.5四大顶尖开源模型
2026-02-25 13:16:58
100万亿Token揭示今年AI趋势,硅谷的这份报告火了
2025-12-09 14:39:59
开源 AI 模型 TOP5,被中国厂商包圆
2025-10-15 18:39:57
微博自研VibeThinker开源模型:训练成本仅7800美元
2025-11-18 15:27:09
开源模型TOP5,被中国厂商包圆了
2025-10-15 17:36:49
张亚勤谈大模型的未来:全球不超10个 且中美将各占三四个
2026-03-18 11:06:09
DeepSeekV3.2技术报告还是老外看得细
2025-12-04 09:09:55
DeepSeek终于把OpenAI逼急了
2025-08-06 16:35:39
778 文章
957753 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47