1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:浙大InftyThink:给大模型装上「思维分段引擎」

学会“适当暂停与总结”,大模型终于实现无限推理。就像人类无法一口气完成复杂数学证明,现有大模型在长上下文推理中也因计算成本激增或上下文长度受限而被迫中断。

浙江大学联合北京大学的研究团队受人类“分段思考+归纳总结”的启发,提出了名为InftyThink的新推理范式。它将单一长推理拆解为多个短片段,并在片段间加入总结,突破了推理长度限制,理论上实现了无限深度推理,同时保持高生成效率。

InftyThink的核心在于“迭代式推理与阶段性总结”。它将长推理分成多次短推理,每次生成有限内容并附带总结,作为后续推理的输入。这种方式既模仿了人类认知过程,又避免了传统推理的上下文长度和计算复杂度问题。此外,它采用“锯齿式”内存管理,每轮推理后清理前轮上下文,仅保留总结,显著降低计算开销。

研究团队还提供了一种数据重构方法,将传统推理数据转换为InftyThink格式,包括片段划分、总结生成和训练样本构建。这种方法无需改变模型结构,可与现有训练流程无缝结合。

实验显示,InftyThink在多个模型上均表现出色。相比传统推理,它不仅提升了推理深度,在AIME24基准上性能提高13%,还提升了生成吞吐量至2.67K Token/s。无论模型大小如何,InftyThink都展现了稳定且显著的性能提升,尤其适合小模型的应用场景。

论文链接:https://arxiv.org/abs/2503.06692
项目链接:https://zju-real.github.io/InftyThink
代码链接:https://github.com/ZJU-REAL/InftyThink

原文链接
本文链接:https://kx.umi6.com/article/19942.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
Kimi即将推出新一代万亿大模型:开源王者刷新 去年已超GPT5
2026-01-20 22:33:50
顶尖技术+标准产品+创新模式+可靠服务,打造大模型商业落地中国范式
2025-12-16 10:32:22
大模型“吃”了全网的语料 “合理使用”与侵权的边界如何划清?
2026-08-28 17:20:10
美团内测万亿级新一代大模型,全程基于国产算力集群训练
2026-04-24 12:12:33
ToC智能体火得快,但更大的价值在企业丨中关村科金@MEET2026
2025-12-12 14:53:17
阿里千问大模型换将,32岁林俊旸官宣告别
2026-03-04 10:27:38
国产AI又一轮爆发 MiniMax M3大模型要来了:10-15倍性能改善
2026-05-27 12:26:00
老黄RTX Spark真机现身Bilibili World!CPU和GPU直接焊在一起,笔记本跑120B大模型
2026-07-12 10:19:23
马斯克直呼完了:Anthropic 73页论文刷屏,全球大模型中招思想病毒!
2026-08-20 16:35:22
备案平均时长缩至2个月 目前已有216款大模型在京完成备案
2026-02-28 19:46:01
花3000元让AI改口,大模型的尽头是广告?
2026-01-06 19:29:29
MiniMax M3一手实测:老黄PPT上74个Logo,我以为能难住它
2026-06-03 00:53:27
上海已发布超150款备案大模型
2026-03-28 20:16:44
24小时热文
更多
扫一扫体验小程序