6月17日凌晨,上海AI独角兽MiniMax发布全球首个开源大规模混合架构推理模型M1。M1支持100万Token上下文窗口,推理输出可达8万Token,且强化训练成本仅53万美金,远低于行业平均水平。该模型定价分三个档位,前两档低于DeepSeek-R1,128k-1M Token档为行业空白。MiniMax称M1所需算力仅为DeepSeek R1的25%-30%,其新算法CISPO使强化学习阶段仅用512块H800 GPU,三周完成训练。此举标志着MiniMax加入大模型竞争,同时开启“开源周”,未来四天将发布更多技术更新。目前,DeepSeek R2的发布时间仍未确定,对行业格局带来不确定性。
原文链接
本文链接:https://kx.umi6.com/article/20355.html
转载请注明文章出处
相关推荐
换一换
倪光南院士:报告显示 80% 的美国 AI 创新企业使用中国开源模型
2025-11-14 11:53:25
华为盘古 Ultra-MoE-718B-V1.1 正式开源并开放下载,模型权重与技术细节全面公开
2025-10-16 17:57:55
全球开源大模型杭州霸榜被终结,上海Minimax M2发布即爆单,百万Tokens仅需8元人民币
2025-10-28 10:42:58
10 万亿 tokens!英伟达贡献全球最大规模开源数据集,并推四大开源 AI 模型
2026-01-06 06:48:15
“开源模型验货官”Perplexity,给Kimi K2盖了个戳
2025-07-21 11:17:17
HuggingChat Omni 集成式 AI 平台发布,可针对用户指令从百款开源模型库中挑选最适合回答
2025-10-18 10:30:57
开源模型TOP5,被中国厂商包圆了
2025-10-15 17:36:49
群核科技升级空间智能战略,发布两款空间开源模型
2025-08-25 17:31:32
爆火全网FLUX.2重磅上线,开源版Nano Banana来了!
2025-11-26 17:55:27
让64张卡像一张卡!浪潮信息发布新一代AI超节点,支持四大国产开源模型同时运行
2025-08-11 16:03:42
开源新标杆!商汤 SenseNova-MARS超 Gemini-3-Pro,模型代码数据全开放
2026-01-30 11:22:29
出圈一周年,DeepSeek的变与不变
2026-01-16 15:50:22
GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!
2026-02-14 16:26:42
746 文章
914657 浏览
24小时热文
更多
-
2026-09-07 12:47:55 -
2026-09-07 10:44:22 -
2026-09-06 21:14:00