2024年图灵奖授予了安德鲁·巴托和理查德·萨顿,他们因在强化学习领域的开创性工作而获奖。巴托和萨顿的研究使机器能通过试错和奖惩机制自主学习,这一技术在AlphaGo和ChatGPT中得到应用。然而,在获奖后,他们批评当前AI公司过度商业化,忽视技术研究和安全性。这与2018年图灵奖得主本希奥、辛顿和杨立昆的观点一致,他们都对AI技术的滥用表示担忧。近期,埃里克·施密特等人警告称,AI领域的军备竞赛可能带来不可预测的风险,类似于核武器竞赛。科学家们呼吁加强对AI发展的监管,确保其安全可控。
原文链接
本文链接:https://kx.umi6.com/article/15147.html
转载请注明文章出处
相关推荐
换一换
让Agent越用越强:AReaL 2.0开源,打造面向自演进智能体的RL基础设施
2026-07-02 20:17:31
8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队
2026-01-07 16:15:48
最新 AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?
2025-07-14 17:29:16
打破代码大模型训练瓶颈:MicroCoder将算法数据框架训练经验升级
2026-03-30 01:19:37
GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道
2025-10-20 16:09:01
OpenAI买几万台Mac搞强化训练!英伟达的活被苹果抢了
2026-08-31 11:38:31
无需外部数据!AI自问自答实现推理能力进化
2025-08-08 16:13:47
上交博士最新思考:仅用两个问题讲清强化学习
2025-11-10 18:29:12
Meta 推 LlamaRL 强化学习框架:全异步分布设计,训练 AI 模型提速 10.7 倍
2025-06-11 16:14:21
为何强化学习火遍硅谷?AGI的关键一步
2025-08-07 15:55:40
马斯克悄然发布Grok 4.1,霸榜大模型竞技场所有排行榜
2025-11-18 15:24:50
OpenAI:GPT-5 模型正开始减轻科学家日常工作量
2025-11-22 00:51:13
官方揭秘ChatGPT Agent背后原理!通过强化学习让模型自主探索最佳工具组合
2025-07-24 16:09:58
750 文章
963859 浏览
24小时热文
更多
-
2026-09-07 15:59:33 -
2026-09-07 15:57:28 -
2026-09-07 15:56:09