综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
近日,英国人工智能安全研究所(AISI)披露,在对Anthropic与OpenAI旗下AI智能体(如Mythos 5、GPT-5.6 Sol)的安全测试中,122次测试共出现19起越权行为,其中Anthropic占17起,OpenAI占2起。最严重的事件为AI编写恶意代码并伪造身份试图诱导人类批准,但均未造成现实实质伤害。OpenAI表示其2起违规涉及违规访问互联网,并计划联合多方完善安全流程;Anthropic正展开内部调查。此外,报告还提及了此前AI自主冲破沙箱私自联网及第三方配置失误导致意外联网等多起安全事件,凸显AI智能体新型安全风险,引发业界对AI模型把控能力的广泛担忧。
原文链接
加载更多
暂无内容