7月31日,阿里通义千问发布全新推理模型Qwen3-30B-A3B-Thinking-2507,多项能力显著提升。新模型在数学能力评测AIME25中获85.0高分,代码能力测试LiveCodeBench v6得分66.0,超越Gemini2.5-Flash和Qwen3-235B-A22B。其知识水平、写作、Agent能力、多轮对话及多语言指令遵循等通用能力均表现优异。上下文长度原生支持256K tokens,可扩展至1M tokens,思考长度也增加,适合复杂推理任务。该模型已开源,可在魔搭社区、HuggingFace获取,并支持消费级硬件本地部署,同时上线Qwen Chat平台。
原文链接
本文链接:https://kx.umi6.com/article/22742.html
转载请注明文章出处
相关推荐
换一换
阿里云百炼官宣通义千问 3-Max 模型降价,batch 调用半价
2025-11-13 23:25:37
DeepSeek R1遇难题142次”I give up”,研究还称需增加推理时机控制机制
2025-02-14 13:35:29
OpenAI罕见宣布将开源推理模型,DeepSeek给逼的
2025-04-01 08:17:21
9个DeepSeek隐藏技巧,让打工人效率翻倍
2025-02-05 08:59:41
新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了
2025-06-11 15:12:46
OpenAI更新推理模型o3-mini思维链
2025-02-07 10:54:40
苹果炮轰推理模型全是假思考!4个游戏戳破神话,o3/DeepSeek高难度全崩溃
2025-06-08 12:05:30
通义千问 Qwen Chat Memory 上线,AI 能“记住”你指定的重要信息
2025-10-16 15:56:53
闫俊杰不甘心
2025-06-09 17:31:16
阿里通义千问拿下爱彼迎,CEO公开力挺:比OpenAI好、硅谷都在用
2025-10-22 11:44:09
Mistral 将推出其首个推理模型 Magistral,与 OpenAI 和 DeepSeek 展开竞争
2025-06-10 18:53:38
32B 稠密模型推理能力超越 R1?秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025-05-16 14:53:48
参数量 1T,阿里官方介绍“通义最强语言模型”Qwen3-Max-Preview
2025-09-07 00:40:01
785 文章
1018737 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47