Meta公司于7月发布Llama 3.1 AI模型及Prompt-Guard-86M模型,旨在检测和应对提示词注入与越狱输入的安全威胁。然而,据科技媒体theregister报道,尽管如此,Prompt-Guard-86M模型仍存在漏洞,仅需在输入中使用空格键即可规避Meta的AI安全系统。漏洞发现者阿曼·普里扬舒在分析该模型与微软基础模型microsoft/mdeberta-v3-base的嵌入权重差异时,揭露了这一机制。普里扬舒指出,只需在字母间插入空格并省略标点,即可使Meta的模型“忽略之前的指令”。Robust Intelligence首席技术官海勒姆·安德森表示,该漏洞使得攻击的成功率从低于3%跃升至接近100%。这一发现凸显了AI安全系统的复杂性和持续挑战。
原文链接
本文链接:https://kx.umi6.com/article/4289.html
转载请注明文章出处
相关推荐
换一换
Karpathy大神问懵DeepSeek!一个emoji竟藏了53个Token,思考10分钟没解释出来
2025-02-14 16:39:19
互联网最古老的恐惧 被AI复活了
2026-09-06 15:01:29
AI浏览器何时才能安全?
2026-03-07 00:49:29
为什么一个弹幕,就能让主播喵一百声?
2025-06-24 10:15:35
OpenAI买几万台Mac搞强化训练!英伟达的活被苹果抢了
2026-08-31 11:38:31
范式与华为达成重磅算力战略合作,成为首批拥抱国产最高端算力底座的AI企业
2026-08-31 16:46:45
今年最难的机器人Demo,“机器人含量”为0
2026-09-03 10:15:24
金融AI的年度大考交卷了:2万名选手、30+家机构、百亿级数据开源
2026-09-04 15:25:38
打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?
2026-09-04 19:40:20
押中SpaceX的硅谷老将,把票投给了一家中国世界模型公司
2026-09-05 23:31:11
模型公司每赚100美元 云厂商拿走近40美元
2026-08-30 14:53:25
香港首个真实开放场景服务机器人落地兰桂坊
2026-09-02 10:25:57
刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代
2026-09-04 06:01:21
803 文章
999676 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47