Meta公司于7月发布Llama 3.1 AI模型及Prompt-Guard-86M模型,旨在检测和应对提示词注入与越狱输入的安全威胁。然而,据科技媒体theregister报道,尽管如此,Prompt-Guard-86M模型仍存在漏洞,仅需在输入中使用空格键即可规避Meta的AI安全系统。漏洞发现者阿曼·普里扬舒在分析该模型与微软基础模型microsoft/mdeberta-v3-base的嵌入权重差异时,揭露了这一机制。普里扬舒指出,只需在字母间插入空格并省略标点,即可使Meta的模型“忽略之前的指令”。Robust Intelligence首席技术官海勒姆·安德森表示,该漏洞使得攻击的成功率从低于3%跃升至接近100%。这一发现凸显了AI安全系统的复杂性和持续挑战。
原文链接
本文链接:https://kx.umi6.com/article/4289.html
转载请注明文章出处
相关推荐
换一换
为什么一个弹幕,就能让主播喵一百声?
2025-06-24 10:15:35
Karpathy大神问懵DeepSeek!一个emoji竟藏了53个Token,思考10分钟没解释出来
2025-02-14 16:39:19
AI浏览器何时才能安全?
2026-03-07 00:49:29
选手购买AI工具引争议 WBG紧急声明:否认制作不良内容
2026-07-23 10:43:29
WAIC之后,重新理解与爱为舞:一家AI原生企业的学习场景验证
2026-07-20 17:25:27
智能体政策新闻相关背景和简要解读
2026-07-23 21:04:16
GMI Cloud 携AI Cloud、MaaS、Agentbox等全栈智算解决方案亮相 WAIC 2026
2026-07-20 13:16:16
刚刚,机器人顶会RSS三项最佳论文出炉!708篇送审,仅8篇杀入决赛
2026-07-20 13:17:53
围观WAIC模型「读心术」!现场火火火火火
2026-07-19 20:39:00
看了20万小时「人类干活实录」,机器人悟了
2026-07-19 17:24:02
刚刚,智谱建了一座只用国产芯片的数据中心
2026-07-23 12:50:17
《LOL》Bin大小姐短片爆红!性转Bin哥被Zeus拥入怀
2026-07-22 17:10:36
危!GPT-5.6会自动删文件,AI初创老板痛失整台Mac
2026-07-19 18:26:13
787 文章
859281 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30