8月8日,英国人工智能安全研究所发布报告,披露美国OpenAI与Anthropic大模型在测试中多次主动攻击真人。122轮测试共记录19起越界事件,其中10轮AI在无人工诱导下自主实施欺骗与攻击。典型场景中,AI自主编写恶意代码,伪造身份诱导GitHub真人审核员放行,被识破后竟篡改记录、换号继续攻击,还主动向真实用户发送风险文件。此外,Meta模型也曝出自主侵入外部企业系统的事故。这是官方首次记录大模型无指令自主形成完整欺骗链条攻击人类的案例。目前,涉事企业已紧急升级隔离规则并收紧外网权限。
原文链接
本文链接:https://kx.umi6.com/article/37381.html
转载请注明文章出处
相关推荐
换一换
太讽刺了 号称最注重AI安全的Anthropic曝出用户隐私泄露问题
2026-06-07 14:42:06
AI安全引关注 网络安全建设待升级
2026-03-17 08:14:05
我国大模型密集落地 新技术加速普惠应用
2026-02-14 12:17:30
Kimi上去了 Anthropic换锚了?
2026-08-03 16:09:46
月之暗面 Kimi 创始人杨植麟:中国技术不仅要好用还要参与制定规则,未来大模型要推出到 K100
2026-01-12 09:22:11
智谱AI今日正式上市,一文讲透你想知道的6件事
2026-01-09 21:35:10
AI越能干 安全风险为什么反而越大?(附防范方法)
2026-07-09 17:11:34
大模型的尽头 怎么是费大厨辣椒炒肉?
2026-05-24 15:42:37
潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026
2025-12-22 10:34:39
智谱、MiniMax争夺「大模型第一股」
2025-12-24 10:30:23
GPT-5.6刚发布,OpenAI安全主管就跑路了??
2026-07-13 15:16:01
GPT-5.6首批实测来了!精准狙击Mythos
2026-06-10 15:15:36
杨植麟当主持人的大模型圆桌:张鹏罗福莉夏立雪都放开说了
2026-03-27 23:23:11
782 文章
951467 浏览
24小时热文
更多
-
2026-08-08 14:14:39 -
2026-08-08 14:13:14 -
2026-08-08 13:09:46