1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

又是王冠:27M小模型超越o3-mini!拒绝马斯克的00后果然不同

近日,一款名为Hierarchical Reasoning Model(HRM)的27M小模型引发关注。它在多项任务中表现优异,甚至超越了参数规模更大的o3-mini-high和DeepSeek-R1等模型。更令人惊叹的是,HRM无需预训练或思维链辅助,仅凭1000个训练样本,就能解决极端数独、30×30迷宫等复杂问题,并在衡量通用智能的ARC-AGI测试中击败众多“大前辈”。其开发者是00后清华校友、Sapient Intelligence创始人王冠,他曾拒绝马斯克的加入邀请,立志挑战Transformer架构。

HRM的核心在于仿脑设计,采用双层循环模块模拟大脑的分层处理与多时间尺度运作机制。高层模块负责抽象规划,低层模块专注细节计算,两者协同工作,确保全局方向正确且局部执行高效。此外,HRM还引入了分层收敛机制,避免过早收敛;近似梯度技术大幅降低内存需求;深度监督机制通过阶段性测试及时纠正偏差;自适应计算时间则动态分配资源,兼顾效率与准确性。

这些创新让HRM在多项任务中表现出色。例如,在9×9极端数独中,现有模型准确率为0%,而HRM几乎全对;在30×30迷宫任务中,其表现远超1.75亿参数的大型Transformer模型。尽管有人质疑HRM泛化能力有限,但其小而精的设计被认为在特定领域更具优势,且对过拟合有极强抵抗力。

王冠8岁开始编程,曾独立开发GitHub揽星5.1k项目OpenChat。2024年,他与联合创始人Austin创立Sapient Intelligence,致力于打造全新大模型架构。HRM的出现不仅是技术突破,更是对Transformer架构的一次大胆挑战。未来,这一仿脑设计或许能引领AI迈向新高度。

论文地址:https://arxiv.org/abs/2506.21734
代码地址:https://github.com/sapientinc/HRM

原文链接
本文链接:https://kx.umi6.com/article/23308.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub
2026-09-26 17:16:43
HuggingFace CEO力荐,Bengio团队也押注:这个1500美元训出的HRM模型,凭什么火了?
2026-06-13 21:37:10
Meta靠自研Manus翻身!股价一夜暴涨11%,登顶苹果商店,增速反超ChatGPT
2026-09-24 11:23:05
斑马智能发布端模型AutoOmni2.0,让元神AI更懂“我的世界”
2026-09-23 17:47:45
智谱“拿走”了什么?
2026-09-21 14:53:05
亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源
2026-09-25 18:26:46
AMD总市值首次突破1万亿美元 持续加码AI算力
2026-09-22 07:26:01
OpenAI闯大祸!GPT竟黑进医保系统,黄仁勋:管不住就关掉
2026-09-25 21:33:53
华为宣布小艺Work正式上线:做PPT、数据分析一句话搞定
2026-09-24 14:32:58
让Token生产更高效:异构混推的关键技术演进与创新实践
2026-09-23 18:54:36
“AlphaGo”杀进足球场!自我对弈140年,机器人成“梅西终结者”
2026-09-25 21:35:27
启仔远仔,想成为第一个被你带回家的硅基伙伴
2026-09-23 13:41:46
Meta个人AI助手刚火13天 Amazon就拉闸了
2026-09-22 18:55:13
24小时热文
更多
扫一扫体验小程序