1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

全球首个端侧全模态理解开源模型来了!这个模型名为Megrez-3B-Omni,具有多项优势。它能轻松处理图片、音频、文本三种模态数据,且体积轻巧,速度飞快。

在图像理解方面,Megrez-3B-Omni作为3B模型,其综合性能表现超过34B的大模型。它在多个主流测试集上精度最高,能够准确理解和分析图像内容,包括复杂的文字识别。

在文本理解方面,Megrez-3B-Omni将上一代14B模型的能力压缩到3B规模,显著降低了计算成本,提升了计算效率。在多个权威测试集上,它取得了端上模型最优精度,为端侧设备的智能化提供了新的可能。

在语音理解方面,Megrez-3B-Omni支持中文和英文的语音输入,处理复杂的多轮对话场景。用户可以通过语音指令与模型互动,实现语音与文本输入的自由切换。

此外,Megrez-3B-Omni在推理速度上也表现出色,最大推理速度比同精度模型快300%。它还提供WebSearch功能,智能判断何时调用外部工具进行搜索,以提高回答的准确性。

无问芯穹技术团队来自清华大学,他们在模型压缩、推理加速及硬件能耗优化等方面拥有深厚经验。Megrez-3B-Omni是他们推出的一个能力预览,未来将继续迭代Megrez系列,提升自动化水平,使端设备的操作更加简便。

该模型已在GitHub和HuggingFace上开源,欢迎访问体验。

Github: https://github.com/infinigence/Infini-Megrez
HuggingFace: https://huggingface.co/Infinigence/Megrez-3B-Omni
体验纯语言版本Megrez-3B-Instruct: https://cloud.infini-ai.com/genstudio/model/mo-c73owqiotql7lozr

原文链接
本文链接:https://kx.umi6.com/article/10258.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
黄仁勋再谈中美AI竞争: 一边批美 一边点名力推中国两款开源模型
2025-05-31 09:01:17
Qwen又立功,全球最快开源模型诞生,超2000 tokens/秒!
2025-09-10 19:40:11
具身开源模型新王!千寻Spirit v1.5模型登顶 RoboChallenge,终结 Pi0.5领跑时代
2026-01-12 16:41:44
腾讯推出智能体开发平台并计划开源多个模型
2025-05-21 11:01:38
阿里开源全模态大模型Qwen3-Omni 可像人类一样听说写
2025-09-24 16:50:21
智谱发布新一代旗舰开源模型 GLM-4.5,专为智能体应用打造
2025-07-28 22:20:02
小米网页 AI 聊天服务惊喜亮相,MiMo-V2-Flash 模型发布、代码能力开源最强
2025-12-17 00:07:31
阿里达摩院首次开源具身智能“三大件”机器人上下文协议
2025-08-11 13:01:00
“开源模型验货官”Perplexity,给Kimi K2盖了个戳
2025-07-21 11:17:17
微软将 OpenAI 最小开源模型 gpt-oss-20b 引入 Windows,本地也能跑
2025-08-07 11:47:50
开源全能图像模型媲美GPT-4o!解决扩散模型误差累计问题
2025-05-12 16:35:41
开源模型TOP5,被中国厂商包圆了
2025-10-15 17:36:49
英伟达发布“行业最高效”Nemotron 3 开源 AI 模型系列,吞吐量达上一代 4 倍
2025-12-15 23:04:58
24小时热文
更多
扫一扫体验小程序