2月3日晚,阿里开源新一代智能体编程模型Qwen3-Coder-Next,仅激活3B参数,性能媲美DeepSeek-V3.2、GLM-4.7等顶级开源模型。该模型通过智能体训练扩展创新,可边思考边编程,显著降低推理成本至同等性能模型的5%~10%,适用于家用电脑和轻量服务器等低成本场景。在SWE-Bench Verified测试中,问题解决率突破70%,并在TerminalBench 2.0等评测中表现优异。其采用大规模可验证编程任务与真实环境反馈训练,擅长处理长上下文推理、工具使用及失败恢复等复杂任务。Qwen3-Coder-Next已开源基座和指令微调两大版本,可在魔搭社区、Hugging Face免费下载商用,支持多种下游应用集成,助力轻量高效智能体编程开发。
原文链接
本文链接:https://kx.umi6.com/article/32569.html
转载请注明文章出处
相关推荐
换一换
对话汪华:现在的大模型,还是支撑不了大体量的免费商业模式
2024-08-15 11:30:06
推理成本比MoE直降83%!字节最新大模型架构入围ICLR 2025
2025-02-12 12:26:20
李飞飞实验室2025 AI报告出炉:AI推理成本降低至1/280
2025-04-08 23:18:28
OpenAI到底亏了多少钱?
2024-08-05 15:55:09
阿里千问开源Qwen3-Coder-Next模型
2026-02-04 08:31:48
推理成本打到1元/每百万token,浪潮信息撬动Agent规模化的“最后一公里”
2025-12-26 15:45:08
字节跳动最新思考模型将于4月17日供用户体验 单位推理成本相比DeepSeek R1降低50%
2025-04-14 12:33:19
直指端侧痛点 豆包向推理算力又“砍了一刀”:新模型架构最高降本83%
2025-02-12 14:35:40
模型推理成本下降最高99%!百川智能发布一站式大模型商业化解决方案
2024-10-31 15:55:01
字节豆包大模型团队提出稀疏模型架构 推理成本最高可降低83%
2025-02-12 13:34:52
美国AI春晚,一盆凉水浇在Agent身上
2025-12-10 16:57:11
DeepSeek 突围奥秘曝光:一招 MLA 让全世界抄作业,150 + 天才集结,开出千万年薪
2025-02-01 15:24:17
豆包提出全新稀疏模型架构 UltraMem,推理成本较 MoE 最高可降 83%
2025-02-12 13:32:45
780 文章
847923 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30