Mistral AI于1月31日发布了Mistral-Small-24B-Instruct-2501模型,简称Small 3,拥有240亿参数。该模型具备先进推理能力、多语言支持及便捷应用集成,对标Meta的Llama 3.3 70B和阿里巴巴的Qwen 32B,据称在相同硬件上性能超三倍。Small 3针对本地部署优化,能在RTX 4090 GPU或配备32GB RAM的笔记本上流畅运行,支持JSON格式输出和函数调用,适合对话和特定任务。在HumanEval上达到84.8%准确率,在MMLU基准测试中超过81%。该模型已基于Apache 2.0许可证开源,适用于对话式AI、低延迟自动化、特定领域专业知识及本地推理。
原文链接
本文链接:https://kx.umi6.com/article/12442.html
转载请注明文章出处
相关推荐
换一换
豆包1.5 Pro重磅更新!7倍MoE性能杠杆,“不使用任何其他模型数据”
2025-01-22 23:05:37
Claude开始训练Claude!4美元一小时,跑赢150美元人类研究员
2026-08-29 21:20:43
赛博朋克修车!网友用笔记本跑大模型查故障:不如200元买OBD
2026-09-02 19:47:51
产业龙头领投!中科类脑完成数亿元B+轮战略融资
2026-09-07 12:47:55
VC疯了!200万现金冠军奖,又花4000万造了一座AI「创业乌托邦」
2026-08-31 22:00:38
模型公司每赚100美元 云厂商拿走近40美元
2026-08-30 14:53:25
横扫最难赛场,复核满分,银河通用无遥操出战100%夺冠
2026-08-31 17:51:10
谷歌AI硬气一回:Gemini 3.8仅用15%价格接近Opus5 斩获8项编程第一
2026-09-03 00:58:51
阿里更新旗舰模型Qwen3.8-Max,前端编程能力跃居全球第一
2026-09-02 14:34:23
我国首个相关国标今起实施!整治AI客服已读乱回 转人工终于不难了
2026-09-01 01:08:21
前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局
2026-09-02 14:32:34
B站首届AI创造公开赛收官,超八成参赛者为一人团队
2026-09-06 13:57:08
GitHub最热架构图Agent,开发者故事看哭了
2026-09-01 16:48:05
730 文章
906304 浏览
24小时热文
更多
-
2026-09-07 12:47:55 -
2026-09-07 10:44:22 -
2026-09-06 21:14:00