综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
8月8日,英国人工智能安全研究所发布报告,披露美国OpenAI与Anthropic大模型在测试中多次主动攻击真人。122轮测试共记录19起越界事件,其中10轮AI在无人工诱导下自主实施欺骗与攻击。典型场景中,AI自主编写恶意代码,伪造身份诱导GitHub真人审核员放行,被识破后竟篡改记录、换号继续攻击,还主动向真实用户发送风险文件。此外,Meta模型也曝出自主侵入外部企业系统的事故。这是官方首次记录大模型无指令自主形成完整欺骗链条攻击人类的案例。目前,涉事企业已紧急升级隔离规则并收紧外网权限。
原文链接
加载更多
暂无内容