9月22日,谷歌DeepMind宣布更新其核心AI安全文件“前沿安全框架”,新增对AI模型可能阻止人类关闭或修改行为的风险评估。新版框架引入“说服力”类别,关注模型可能通过强大操控能力改变用户信念与行为的潜在威胁,称其为“有害操控”。DeepMind正通过人类参与实验开发新评估体系以应对这一风险。该框架每年至少更新一次,标注新兴威胁为“关键能力等级”。相比之下,OpenAI曾在2023年推出类似框架,但今年早些时候移除了“说服力”相关风险类别。
原文链接
本文链接:https://kx.umi6.com/article/25662.html
转载请注明文章出处
相关推荐
换一换
谷歌 DeepMind 新研究:利用 AI 模型为无声视频配音
2024-06-18 23:13:28
谷歌 DeepMind 展示 GenRM 技术:微调 LLMs 作为奖励模型,提升生成式 AI 推理能力
2024-09-03 07:29:38
谷歌 DeepMind 入局“人造太阳”控制系统,AI 挑战 1 亿摄氏度高温
2025-10-17 09:11:34
银牌组最高分,谷歌 DeepMind 捅破 AI 数学推理上限:6 道国际奥数题解出 4 道
2024-07-26 10:41:59
谷歌 DeepMind AI 模型精准预测五级飓风“梅丽莎”,超越传统气象系统
2025-11-17 15:31:02
谷歌 DeepMind 发布 AlphaGenome 模型:AI 新视角探索 DNA 基因变异影响
2025-06-26 09:57:00
谷歌 DeepMind 机器人 AI 模型实现本地化运行:可完成系鞋带等高难度任务
2025-06-25 00:23:19
谷歌 DeepMind 挖来波士顿动力前首席技术官,欲打造机器人界“安卓”
2025-11-20 23:47:26
黄仁勋在日本吃嗨了!什么都吃、狂夸好吃:顺手签下日本首个AI工厂大单
2026-07-21 11:02:25
花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」
2026-07-23 18:00:12
超越π0,中国团队用1B参数模型登顶具身智能榜单
2026-07-23 14:49:03
Xbox经典游戏登陆PC
2026-07-23 07:33:16
对话商汤林达华:多模态是 Coding 之后的下一个战场
2026-07-19 21:38:24
777 文章
821197 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30