1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:浙大InftyThink:给大模型装上「思维分段引擎」

学会“适当暂停与总结”,大模型终于实现无限推理。就像人类无法一口气完成复杂数学证明,现有大模型在长上下文推理中也因计算成本激增或上下文长度受限而被迫中断。

浙江大学联合北京大学的研究团队受人类“分段思考+归纳总结”的启发,提出了名为InftyThink的新推理范式。它将单一长推理拆解为多个短片段,并在片段间加入总结,突破了推理长度限制,理论上实现了无限深度推理,同时保持高生成效率。

InftyThink的核心在于“迭代式推理与阶段性总结”。它将长推理分成多次短推理,每次生成有限内容并附带总结,作为后续推理的输入。这种方式既模仿了人类认知过程,又避免了传统推理的上下文长度和计算复杂度问题。此外,它采用“锯齿式”内存管理,每轮推理后清理前轮上下文,仅保留总结,显著降低计算开销。

研究团队还提供了一种数据重构方法,将传统推理数据转换为InftyThink格式,包括片段划分、总结生成和训练样本构建。这种方法无需改变模型结构,可与现有训练流程无缝结合。

实验显示,InftyThink在多个模型上均表现出色。相比传统推理,它不仅提升了推理深度,在AIME24基准上性能提高13%,还提升了生成吞吐量至2.67K Token/s。无论模型大小如何,InftyThink都展现了稳定且显著的性能提升,尤其适合小模型的应用场景。

论文链接:https://arxiv.org/abs/2503.06692
项目链接:https://zju-real.github.io/InftyThink
代码链接:https://github.com/ZJU-REAL/InftyThink

原文链接
本文链接:https://kx.umi6.com/article/19942.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
ToC智能体火得快,但更大的价值在企业丨中关村科金@MEET2026
2025-12-12 14:53:17
不整虚的!中美AI同步加速:47天30次更新,中国AI的最强主场究竟在哪?
2026-02-22 18:50:22
大模型的尽头 怎么是费大厨辣椒炒肉?
2026-05-24 15:42:37
郑州:在医疗、教育、物流、防灾减灾等领域打造一批大模型典型示范 形成“AI+千行百业”全场景体系
2026-05-09 20:36:41
Manus救不了Meta
2026-01-08 20:35:12
中金:2026年大模型在强化学习、模型记忆、上下文工程等方面将取得更多突破
2026-02-05 08:39:59
Gartner首次发布大模型报告:火山引擎排名中国厂商第一
2025-11-20 12:17:36
中信建投通信及人工智能中期策略:大模型持续迭代 算力需求强劲增长
2026-05-13 09:05:16
独家专访|苏炜杰加入OpenAI:Scaling Law撞墙后为什么需要数学家出手?
2026-06-29 15:36:01
国务院:深入实施“人工智能+”行动 支持采购大模型、智能体服务
2026-04-21 17:21:09
腾讯调整大模型组织架构:姚顺雨加盟,向总裁刘炽平汇报
2025-12-18 15:51:59
亚马逊云科技发布多款大模型
2025-12-03 14:25:54
大模型收入暴涨1076%,港股AGI第一股首份年报:一年狂揽12亿,属实把商业化玩明白了
2026-03-27 17:08:13
24小时热文
更多
扫一扫体验小程序