Mistral AI于1月31日发布了Mistral-Small-24B-Instruct-2501模型,简称Small 3,拥有240亿参数。该模型具备先进推理能力、多语言支持及便捷应用集成,对标Meta的Llama 3.3 70B和阿里巴巴的Qwen 32B,据称在相同硬件上性能超三倍。Small 3针对本地部署优化,能在RTX 4090 GPU或配备32GB RAM的笔记本上流畅运行,支持JSON格式输出和函数调用,适合对话和特定任务。在HumanEval上达到84.8%准确率,在MMLU基准测试中超过81%。该模型已基于Apache 2.0许可证开源,适用于对话式AI、低延迟自动化、特定领域专业知识及本地推理。
原文链接
本文链接:https://kx.umi6.com/article/12442.html
转载请注明文章出处
相关推荐
换一换
豆包1.5 Pro重磅更新!7倍MoE性能杠杆,“不使用任何其他模型数据”
2025-01-22 23:05:37
阿里云:真武芯片超节点已成功适配Qwen3.8,上线百炼提供推理服务
2026-07-23 15:50:49
WAIC不筹量子重磅发布“量筹一号”——原子量子人工智能基座
2026-07-20 13:11:25
燧原科技发布云燧ESL64-O超节点 突破AI芯片互联瓶颈
2026-07-19 16:23:14
超越π0,中国团队用1B参数模型登顶具身智能榜单
2026-07-23 14:49:03
Halliday发布第二代AI眼镜Halliday G2,AI功能走向“实时参与会议”
2026-07-22 13:00:11
黄仁勋高情商表态:开源AI会让美国更安全 AI竞赛中美都会赢
2026-07-22 22:18:04
GMI Cloud “无界造物节”在WAIC圆满完赛,“MaaS+创意”赋能 AI 创作新生态!
2026-07-20 17:23:45
2026世界人工智能大会“未来计算·未来算力”专题论坛在沪召开,共识凝聚五问
2026-07-19 19:28:01
刚刚,智谱建了一座只用国产芯片的数据中心
2026-07-23 12:50:17
物理AI的闭环,终于有人跑通了:日冕+远图万台级部署计划官宣
2026-07-22 11:54:15
国家具身智能应用中试基地发布首个合作世界模型 魔芯科技MoWorld 3D正式亮相
2026-07-20 17:22:05
新晋菲尔兹奖得主,当天宣布加入OpenAI
2026-07-24 10:29:19
720 文章
778795 浏览
24小时热文
更多
-
2026-07-24 11:35:13 -
2026-07-24 10:33:39 -
2026-07-24 10:31:58