阿里通义千问团队于12月25日发布了QVQ-72B-Preview开源视觉推理模型,该模型能在复杂物理问题上通过逻辑推理解决问题。QVQ-72B-Preview在MMMU、MathVista、MathVision及OlympiadBench四个数据集上进行了评估,表现出色,尤其在MMMU基准测试中得分70.3,超越了Qwen2-VL-72B-Instruct。然而,该模型仍存在语言混合、递归推理等问题,需谨慎使用。阿里通义千问团队表示,QVQ-72B-Preview是实验性研究模型,专注于增强视觉推理能力。
原文链接
本文链接:https://kx.umi6.com/article/10719.html
转载请注明文章出处
相关推荐
换一换
英伟达开源多个代码大模型 以阿里通义千问为底座
2025-05-09 15:51:07
阿里通义千问开源 Qwen2-Audio 7B 语音交互大模型:自由互动,无需输入文本
2024-08-13 13:12:06
日经新闻称阿里通义千问已成日本AI开发基础
2025-05-12 14:34:34
阿里通义千问:Qwen Code每天可享2000次免费调用
2025-08-12 18:24:15
阿里通义千问推出Qwen Chat桌面端
2025-07-12 08:49:02
阿里通义千问推出Qwen3-Max-Thinking尝鲜版
2025-11-04 17:23:23
Qwen2-Math 开源 AI 模型发布:阿里通义千问家族新成员,数学能力超 GPT-4o
2024-08-09 10:57:07
阿里 AI 实力获斯坦福权威报告盖章!通义千问贡献排名全球第三、中国第一
2025-04-11 16:57:29
阿里通义千问大模型负责人周畅将离职创业 | 36氪独家
2024-07-17 21:09:45
阿里通义千问正式推出QVQ-Max视觉推理模型第一版
2025-03-28 13:48:04
爆火出圈后 Manus与阿里通义千问达成合作
2025-03-11 20:49:32
阿里通义千问推出视觉推理模型 QVQ-Max:可分析、推理图片和视频内容
2025-03-28 11:43:06
阿里通义千问推出编程模型Qwen3-Coder-Flash
2025-08-01 09:24:35
817 文章
918578 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30