正文:11月26日,阿里千问的视觉理解模型Qwen3-VL和Qwen2.5-VL在空间推理基准测试SpatialBench榜单中位列前两名,超越Gemini 3、GPT-5.1等国际顶尖模型。SpatialBench是一项衡量多模态模型在空间、结构、路径等方面综合推理能力的新兴标准,对具身智能落地至关重要。Qwen3-VL和Qwen2.5-VL分别获得13.5分和12.9分,远超Gemini 3.0 Pro Preview(9.6分)和GPT-5.1(7.5分)。尽管AI整体表现仍不及人类基准线(约80分),但Qwen3-VL在视觉感知和多模态推理方面取得突破,可实现‘带图推理’和‘视觉编程’,并增强3D检测能力,助力机器人精准抓取物体。Qwen3-VL已开源多个版本,并上线千问APP供用户免费体验。
原文链接
本文链接:https://kx.umi6.com/article/29185.html
转载请注明文章出处
相关推荐
换一换
阿里千问团队谈“对标 ChatGPT”:希望他们没有的能力我们有
2025-11-17 12:22:42
阿里开源视觉理解模型Qwen3-VL
2025-09-24 14:43:41
AI开始“动手”了,全世界第一个带头的是阿里千问
2026-01-15 13:36:25
消息称阿里千问明天将有“重磅产品迭代”,C 端月活用户已破亿
2026-01-14 12:31:30
阿里千问“任务助理 1.0”开启邀测,未来全面免费开放
2026-01-15 11:39:24
中国唯一!阿里千问斩获全球AI顶会最佳论文
2025-11-28 17:38:06
大模型掌握人类空间思考能力!三阶段训练框架学会“边画边想”,5个基准平均提升18.4%
2025-06-21 15:10:12
阿里千问,加持首个奥运官方大模型
2026-02-05 11:45:42
阿里千问发布“2025 十大 AI 提示词”:“股票”排名榜首
2025-12-22 10:42:49
豆包视觉理解模型发布
2024-12-18 10:30:52
阿里千问开始蹬鼻子上脸了
2025-11-28 15:32:48
阿里千问(Qwen)衍生模型数量破 10 万,位居全球开源模型榜首
2025-02-25 17:02:40
视觉理解模型定价低于同行85% 火山引擎谭待回应:仍然能有合理的毛利
2024-12-20 11:28:56
789 文章
868585 浏览
24小时热文
更多
-
2026-07-24 11:35:13 -
2026-07-24 10:33:39 -
2026-07-24 10:31:58