1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

强化学习之父Richard Sutton近期指出,大型语言模型(LLM)的主导地位只是暂时现象,未来五年甚至十年内不会是技术前沿。他在新加坡国立大学120周年校庆演讲中再次强调,模仿人类思维的AI短期内可能提升性能,但从长远来看会阻碍研究进展。

Sutton在19年出版的《痛苦的教训》中就提到,单纯依赖人类数据训练的AI难以实现突破性创新。他近期发表的论文《欢迎来到体验时代》进一步阐述了这一观点,并提出扩展计算能力才是关键。

他认为,AI应从依赖人类数据转向通过自主交互获取“体验数据”,从而实现自我进化和创新。例如,AlphaGo在围棋比赛中展现出超越人类的策略,正是这种体验式学习的结果。未来AI将进入“体验时代”,通过不断实践和反馈提升能力,探索未知领域。

此外,Sutton主张采用去中心化的合作模式,让不同目标的AI自主协作,如同人类社会中的经济体系。他鼓励将AI视为推动设计进化的工具,而非单纯的产物。

Sutton的观点引发热烈讨论,支持者认为LLM可能触及瓶颈,而反对者则认为其仍是通向通用人工智能的重要一步。

原文链接
本文链接:https://kx.umi6.com/article/20004.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
不更新参数就能强化学习!OpenAI翁家翌提出新范式:决策只需AI手搓一个.py 文件
2026-05-09 17:26:04
上海 AI 实验室联合清华等大学突破强化学习算法,攻克 AI 推理熵崩溃难题
2025-06-04 08:15:30
Claude 4如何思考?资深研究员回应:RLVR已在编程/数学得到验证
2025-05-24 15:19:19
蚂蚁集团开源 Awex 框架,秒级完成 TB 级参数交换
2025-11-20 10:17:17
Meta万引强化学习大佬跑路!用小扎原话作为离别寄语,扎心了
2025-08-26 13:43:07
全球闲置算力训个模型,性能媲美R1,老黄“天塌了”
2025-05-16 14:29:01
奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式
2025-07-11 11:34:40
发自 凹非寺量子位 | 公众号 QbitAI 奥特曼点名表扬了两个波兰人。 没有他们,OpenAI就不是今天的样子。 他们是OpenAI首席科学家Jakub Pachocki以及头衔为“Technical Fellow”的Szymon Sidor。 △左:Jakub Pachocki,右:Szymon Sidor 两人不仅是波兰老乡,而且是高中同学,读博时分别选择了计算机科学和机器人,后来又在OpenAI重聚。 在ChatGPT风靡全球、每天服务数亿用户的今天,奥特曼感慨大多数人永远不会想到背
2025-09-09 18:18:27
RLinf v0.3来了!从模型生态到真机部署五大能力跃升,无问芯穹与清华大学联合打造
2026-07-16 17:52:14
蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王
2025-10-24 11:36:00
Thinking Machine新研究刷屏!结合RL+微调,小模型训练更具性价比
2025-10-28 10:41:47
突破Agent长程推理效率瓶颈!MIT&NUS联合推出强化学习新训练方法
2025-08-22 16:50:16
上交博士最新思考:仅用两个问题讲清强化学习
2025-11-10 18:29:12
24小时热文
更多
扫一扫体验小程序