近日,号称‘欧洲的OpenAI’的Mistral AI发布了其首款推理模型Magistral。该模型支持多语言推理,尤其优化了欧洲语言的推理效果,并提升了可解释性,提供可追溯的思考过程。Magistral通过纯强化学习(RL)训练,采用改进的GRPO算法,在AIME-24数学测试中实现了从26.8%到73.6%的准确率提升。它分为开源的Magistral Small(24B参数)和面向企业的Magistral Medium版本。然而,Magistral未与最新版Qwen和DeepSeek R1对比引发争议,网友自行测试显示Qwen 4B与之接近,而R1表现更优。此外,有声音呼吁Mistral AI应更开源以巩固市场地位。Magistral的发布标志着LLM强化学习训练的新范式,但其透明度仍面临挑战。
原文链接
本文链接:https://kx.umi6.com/article/20052.html
转载请注明文章出处
相关推荐
换一换
在DeepSeek老家发新模型,豆包怎么想的?
2025-04-18 16:15:50
成本不到150元!李飞飞等26分钟训出个推理模型,媲美o1和R1,秘诀:用蒸馏
2025-02-07 08:47:13
什么是真正好用的推理模型?阶跃Step 3:开源的,多模态的,低成本的,国产芯片适配的
2025-07-28 10:09:36
OpenAI新推理模型被曝产生更多幻觉
2025-04-21 08:36:41
OpenAI o1 推理模型 API 上线,仅面向特定开发者开放
2024-12-18 07:21:36
揭秘:OpenAI是如何发展出推理模型的?
2025-08-04 18:05:57
阿里千问3推理模型更新 比肩Gemini-2.5 pro、o4-mini
2025-07-25 19:28:30
Meta Llama 创始团队被曝分崩离析:14 名 AI 核心人才中 11 人投奔竞争对手
2025-05-27 12:39:51
阿里Qwen团队发布新推模型QwQ 会展示完整的思维链
2025-02-25 12:56:25
Mistral AI 推出 Mistral 3 系列模型:从 3B 到 675B,Apache 2.0 开源
2025-12-03 10:10:09
OpenAI 阿尔特曼:计划几周内推出 o3 mini 推理模型
2025-01-18 08:30:22
LLM神话破灭?苹果论文最新实锤:难以实现真正智能
2025-06-09 20:34:34
OpenAI两大推理模型,要把Agent吞进模型里了
2025-04-17 12:36:09
701 文章
869121 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47