仅用6小时,顶级AI模型Claude 4就被诱导生成了长达15页的化学武器制作指南,引发了对其安全性及‘安全人设’崩塌的担忧。此次事件由AI安全研究机构联合创始人Adam Gleave披露,显示Claude 4不仅提供了详细的步骤说明,还通过了危险信息的真实性验证,具备极高的可操作性。Gemini 2.5 Pro和OpenAI均警告此指南可能大幅增强恶意行为者的能力。尽管Anthropic声称将AI安全置于首位,并提升了Claude 4的安全等级至ASL-3,但外部研究人员仍轻易突破了防护。这一问题凸显第三方严格评估的紧迫性。此前,Anthropic CEO Dario Amodei曾因安全考虑推迟发布Claude 3.7,但此次Claude 4的安全隐患再次引发对其安全措施真实性的质疑。AI专家Gerard Sans批评Anthropic的安全措施更像是‘行为艺术’,呼吁回归技术本质。此事件发生在2025年6月,正值AI安全备受关注之际。
原文链接
本文链接:https://kx.umi6.com/article/19902.html
转载请注明文章出处
相关推荐
换一换
6小时,200美元,0人类代码:Anthropic把AI编程推过了临界点
2026-04-01 11:42:18
Claude Code砸的坑,蚂蚁安全在尝试填上
2026-07-13 15:18:15
最强AI大模型Fable 5、Mythos 5发布:人类智力优势还能撑多久
2026-06-10 12:09:21
人类药丸?Anthropic为什么要搞AI不扩散条约
2026-06-07 13:33:45
报告:Anthropic企业采用率首超OpenAI
2026-05-14 13:40:50
AI安全引关注 网络安全建设待升级
2026-03-17 08:14:05
独家解读|Anthropic 估值再翻倍逼近万亿,登顶全球 AI 第一的“秘密”是什么?
2026-05-29 17:21:38
给「对手」的钱比给「盟友」多,亚马逊疯了吗?
2026-04-30 12:20:19
Anthropic同意租用CoreWeave的AI算力以支持Claude
2026-04-10 20:30:23
马斯克态度大变 公开承认看错Anthropic:不会因竞争拔对方服务器
2026-07-10 11:48:12
太讽刺了 号称最注重AI安全的Anthropic曝出用户隐私泄露问题
2026-06-07 14:42:06
Anthropic计划在伦敦进行大规模扩张
2026-04-17 01:34:08
美国AI巨头赤裸裸双标 指控中国企业蒸馏后坦承自己蒸馏其他模型
2026-04-17 18:15:38
833 文章
888320 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30