2026年2月11日,蚂蚁集团开源发布了全模态大模型Ming-Flash-Omni 2.0。这是业界首个全场景音频统一生成模型,能够在同一条音轨中同时生成语音、环境音效与音乐。用户可通过自然语言指令,灵活控制音色、语速、语调、音量、情绪及方言等参数。该模型在推理阶段实现了3.1Hz的极低推理帧率,支持分钟级长音频的实时高保真生成,为音频内容创作提供了全新工具。(记者 黄心怡)
原文链接
本文链接:https://kx.umi6.com/article/32846.html
转载请注明文章出处
相关推荐
换一换
从“百模大战”到行业整合,大模型创企开始被大厂“收编”
2024-11-25 11:06:22
蚂蚁发布并开源万亿参数思考模型Ring-1T
2025-10-14 17:25:02
蚂蚁投了一家上海具身智能公司
2026-02-10 16:23:42
蚂蚁集团、联想控股等入股旷视科技
2025-04-07 20:15:06
蚂蚁集团人工智能企业服务总部、西部研发中心落地成都
2025-07-25 14:25:17
蚂蚁集团披露AI普惠进展:三大AI管家已服务超1.3亿用户 43%来自三线及以下城市
2025-06-30 11:44:08
前蚂蚁集团资深副总裁蒋国飞将加盟中国电子集团
2024-07-15 10:14:19
蚂蚁下场自研具身智能机器人 已开启相关人员招聘
2025-02-19 16:57:01
智元机器人、蚂蚁集团等成立未来科技公司
2025-11-11 11:11:12
蚂蚁集团向假医疗广告“宣战”,旗下 AI 健康管家 AQ 上线多项打假措施
2025-08-18 14:46:24
马云现身,蚂蚁换帅
2024-12-10 13:54:18
蚂蚁集团全力拥抱AI:大模型训练降本、一体机发布、智能眼镜招兵买马
2025-03-24 19:14:50
阿里千问全模态大模型Qwen3.5-Omni上线
2026-03-30 22:11:01
748 文章
867091 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30