LongCat-Flash-Thinking

综合

7*24 快讯

AI科普

合作

全部

英雄令

项目方

开发者

产品方

投资者

全球首个开源“重思考”模型：美团 LongCat-Flash-Thinking-2601 发布，工具调用能力登顶开源 SOTA

2026年1月16日，美团LongCat团队发布并开源全球首个支持“重思考”模式的模型LongCat-Flash-Thinking-2601。该模型在工具调用、智能体搜索等核心评测中达到开源SOTA水平，尤其在复杂任务中的泛化能力超越Claude，显著降低新工具适配成本。其创新的“重思考”模式通过并行思考和总结归纳两阶段优化推理过程，确保决策可靠。评估显示，该模型在编程（LCB评分82.8）、数学推理（AIME满分）、工具调用（τ²-Bench评分88.2）及搜索能力（BrowseComp评分73.1）等方面表现领先。此外，美团设计全新自动化任务合成流程验证模型泛化能力，实验结果优异。模型已完整开源，支持在线免费体验，并提供GitHub、Hugging Face等多个平台访问链接。

原文链接

WisdomTrail

01-16 14:36:37

LongCat-Flash-Thinking-2601

工具调用

重思考模式

分享至

打开微信扫一扫

内容投诉

生成图片

美团发布高效推理模型 LongCat-Flash-Thinking，达到 SOTA 水平

9月22日，美团LongCat团队发布全新高效推理模型LongCat-Flash-Thinking，综合性能达全球开源模型最先进水平（SOTA）。该模型在逻辑、数学、代码及智能体任务中表现卓越，是国内首个结合“深度思考+工具调用”与“非形式化+形式化”推理能力的语言模型。通过创新架构如领域并行强化学习和异步弹性共卡系统，模型实现高效推理与稳定训练，在复杂任务中显著优化资源利用。多项权威评测显示，其在ARC-AGI、HMMT、LiveCodeBench等基准测试中刷新纪录，超越OpenAI o3、Gemini2.5 Pro等顶尖模型。项目已开源，地址包括Hugging Face与Github。

原文链接

阿达旻

09-22 15:58:35

LongCat-Flash-Thinking

SOTA

推理模型

分享至

打开微信扫一扫

内容投诉

生成图片

美团发布高效推理模型LongCat-Flash-Thinking

9月22日，美团LongCat团队发布全新高效推理模型LongCat-Flash-Thinking。该模型融合了「深度思考+工具调用」与「非形式化+形式化」推理能力，能够更高效地完成复杂任务。目前，模型已在HuggingFace和Github全面开源，供开发者自由使用。这一发布为AI推理领域提供了新工具，引发广泛关注。

原文链接