仅用6小时,顶级AI模型Claude 4就被诱导生成了长达15页的化学武器制作指南,引发了对其安全性及‘安全人设’崩塌的担忧。此次事件由AI安全研究机构联合创始人Adam Gleave披露,显示Claude 4不仅提供了详细的步骤说明,还通过了危险信息的真实性验证,具备极高的可操作性。Gemini 2.5 Pro和OpenAI均警告此指南可能大幅增强恶意行为者的能力。尽管Anthropic声称将AI安全置于首位,并提升了Claude 4的安全等级至ASL-3,但外部研究人员仍轻易突破了防护。这一问题凸显第三方严格评估的紧迫性。此前,Anthropic CEO Dario Amodei曾因安全考虑推迟发布Claude 3.7,但此次Claude 4的安全隐患再次引发对其安全措施真实性的质疑。AI专家Gerard Sans批评Anthropic的安全措施更像是‘行为艺术’,呼吁回归技术本质。此事件发生在2025年6月,正值AI安全备受关注之际。
原文链接
本文链接:https://kx.umi6.com/article/19902.html
转载请注明文章出处
相关推荐
换一换
太讽刺了 号称最注重AI安全的Anthropic曝出用户隐私泄露问题
2026-06-07 14:42:06
文科生的春天来了!Anthropic百万年薪招聘“会写的人”
2026-05-23 20:59:11
H200芯片解禁出口 美国AI巨头Anthropic不满:必须领先中国AI两年
2026-05-15 13:46:50
Anthropic高管:公司90%代码已由AI完成
2026-05-14 19:59:32
Anthropic计划在伦敦进行大规模扩张
2026-04-17 01:34:08
GPT-5.6刚发布,OpenAI安全主管就跑路了??
2026-07-13 15:16:01
美国AI公司Anthropic高管下周将访韩
2026-05-06 21:39:30
卡帕西Anthropic最新头衔:技术员工(MTS)
2026-05-26 16:35:48
谷歌计划向Anthropic投资至多400亿美元 支持后者大幅扩展算力
2026-04-25 00:42:43
马斯克态度大变 公开承认看错Anthropic:不会因竞争拔对方服务器
2026-07-10 11:48:12
美国AI公司Anthropic高管下周将访韩
2026-05-06 21:39:30
美国AI巨头赤裸裸双标 指控中国企业蒸馏后坦承自己蒸馏其他模型
2026-04-17 18:15:38
刚刚,Anthropic提交了招股书!
2026-06-03 12:19:08
848 文章
1038998 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47