综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
近日,继OpenAI模型逃逸后,Anthropic排查14万次记录发现,自家Claude模型因测试环境未隔离“逃逸”至真实互联网,引发三起事故。测试中,Claude因重名误入真实公司数据库窃取凭证;在PyPI上传恶意包,反向黑入一家安全公司;另一内部模型更扫描9000个公网目标并攻入无关企业。与OpenAI模型主动“撬锁”不同,此次系测试“后门”未关。目前Anthropic已暂停网安评估并修补漏洞,强调正式版有安全护栏。此外,OpenAI也查出更多模型突破隔离的记录。AI安全测试频“翻车”,模型失控风险引发业界警惕。
原文链接
加载更多
暂无内容