2026-06-13 21:37:10
HuggingFace CEO力荐,Bengio团队也押注:这个1500美元训出的HRM模型,凭什么火了?
阅读:1097
近日,Sapient Intelligence发布1B参数模型HRM-Text,获HuggingFace CEO力荐,图灵奖得主Bengio团队新论文也高度复用其核心架构。该模型训练成本仅约1500美元,却在MATH等推理测试中媲美主流2B至7B模型。其核心突破在于HRM分层推理架构:摒弃传统长文本思维链,让模型在输出前于潜空间内进行“高低层双脑区”的多轮递归计算,实现真正的内部思考。目前团队已全面开源相关论文、代码与权重。HRM-Text的成功打破了唯算力规模论,标志着AI推理正从“写出思维链”向“形成内部思维结构”演进,为下一代推理模型指明新方向。
原文链接
本文链接:https://kx.umi6.com/article/36526.html
转载请注明文章出处
相关推荐
换一换
推理模型新路线开源!与DeepSeek截然不同,抛弃思维链不用人类语言思考
2025-02-11 15:54:11
又是王冠:27M小模型超越o3-mini!拒绝马斯克的00后果然不同
2025-08-10 13:46:12
欧盟AI透明度准则8月2日起生效:聊天机器人需自报身份
2026-07-26 17:26:25
数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?
2026-07-26 17:28:08
上海这场大赛有点“野”:让AI自主科研、控核聚变、认甲骨文
2026-07-23 09:36:06
OPC创业者看过来,最高10万美元云资源等你拿
2026-07-24 13:45:42
全球首个Agentic扩散模型来了:边行动边纠错,128K上下文追平自回归
2026-07-28 12:57:42
Kimi K3 已提前亮相?神秘模型「Kivine」现身,百万上下文能力惊艳全球
2026-07-23 12:48:44
半价干翻Fable 5?Opus 5实测炸场,网友:差点从椅子上摔下来
2026-07-25 20:41:43
超越π0,中国团队用1B参数模型登顶具身智能榜单
2026-07-23 14:49:03
Ilya获黄仁勋50亿美元押注:“是时候Scaling了”
2026-07-28 14:01:38
WWW 2026 唯一最佳长文|大模型该信「查到的」还是「记得的」?|GAIR Paper 110
2026-07-27 11:06:04
Xbox经典游戏登陆PC
2026-07-23 07:33:16
720 文章
789460 浏览
24小时热文
更多
-
2026-07-29 01:27:28 -
2026-07-29 00:24:42 -
2026-07-28 19:13:50