1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:推理模型无需深思熟虑也能更高效

正文:
其实……推理模型无需冗长思考也能有效推理!这听起来或许有些反常识,毕竟人们常认为推理模型的强大得益于详尽的思考过程。然而,这种耗时且需大量算力的过程并非唯一出路。UC伯克利与艾伦实验室团队的研究表明,“无思考(NoThinking)”方法可能更为高效。

NoThinking方法通过简单的提示绕过显式思考,直接生成解决方案。实验显示,在低资源或低延迟情况下,该方法的表现优于传统思考方式,实现了精度与延迟之间的更优平衡。即使在其他场景下,NoThinking在部分数据集上的表现也超越了传统思考方法。

研究团队基于DeepSeek-R1-Distill-Qwen模型提出NoThinking方法。传统“思考”方法会让模型逐步分解问题、验证步骤并得出答案,而NoThinking则直接从预设的“思考”标记开始生成最终方案,省去了详细思考步骤,减少了token数量,提升了推理速度。

在数学、编程及形式定理证明等任务中,NoThinking方法展现出了显著优势。例如,在AIME和AMC数据集上,相同token预算下,NoThinking的准确率明显高于传统方法。而在MiniF2F和ProofNet数据集中,NoThinking在保持高准确性的同时大幅降低了计算成本。编程任务中,低资源环境下NoThinking效率更高,高资源时效果接近传统方法。

此外,NoThinking在多次采样中表现出更高的多样性,pass@k指标随k值增大而提升。结合并行扩展,NoThinking不仅降低了延迟,还减少了token使用量,尤其在有校验器的任务中表现尤为突出。

这项研究颠覆了“推理模型必须依赖详细思考过程”的观念,表明更高效的推理方式是可行的。尽管实际应用中可能需要额外的人工筛选,但这一新视角无疑为未来推理模型的优化提供了新思路。或许不久后,我们等待精准答案的时间会大大缩短。

原文链接
本文链接:https://kx.umi6.com/article/17935.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
OpenAI 最强推理模型、能够“思考”图片,o3 和 o4-mini 正式发布
2025-04-17 02:19:26
DeepSeek R1遇难题142次”I give up”,研究还称需增加推理时机控制机制
2025-02-14 13:35:29
2025 年考研数学一得 126 分,智谱深度推理模型 GLM-Zero 预览版上线
2024-12-31 18:45:44
林俊旸离职后首次发声!复盘千问的弯路,指出AI的新路
2026-03-27 15:02:31
在DeepSeek老家发新模型,豆包怎么想的?
2025-04-18 16:15:50
阿里千问3推理模型更新 比肩Gemini-2.5 pro、o4-mini
2025-07-25 19:28:30
DeepSeek小心,帝国反击战打响了
2025-02-26 22:53:26
o3-pro答高难题文字游戏引围观,OpenAI前员工讽刺苹果:这都不叫推理那什么叫推理
2025-06-13 12:06:17
揭秘:OpenAI是如何发展出推理模型的?
2025-08-04 18:05:57
法国 AI 实验室 Mistral 推出推理模型 Magistral 系列,Small 版已开源
2025-06-11 09:04:46
OpenAI更新推理模型o3-mini思维链
2025-02-07 10:54:40
MiniMax 推出全球首个开源大规模混合架构的推理模型 M1:456B 参数,性能超 DeepSeek-R1
2025-06-17 17:28:14
OpenAI 阿尔特曼:计划几周内推出 o3 mini 推理模型
2025-01-18 08:30:22
24小时热文
更多
扫一扫体验小程序