近日,AI领域传出大模型‘中毒’事件,表现为输出异常内容,如推荐虚假信息或编造新闻。Anthropic研究显示,仅需250篇恶意文档即可让130亿参数的模型中毒。中毒原因包括训练数据被污染(数据投毒)、运营阶段的对抗样本攻击等。幕后黑手可能是商业利益驱动的广告植入、技术炫耀的个人或网络犯罪团伙。中毒后果严重,可能传播虚假信息、诱导用户决策,甚至威胁公共安全,如自动驾驶误判交通标志。专家建议通过数据审核、对抗训练及行业协作构建防御体系,提升模型免疫力。
原文链接
本文链接:https://kx.umi6.com/article/26995.html
转载请注明文章出处
相关推荐
换一换
Meta 开源 LlamaFirewall 防护工具,助力构建安全 AI 智能体
2025-05-09 14:52:36
0.01%虚假训练文本可致有害内容增加11.2% 警惕人工智能“数据投毒”
2025-08-05 07:08:37
蚂蚁数科发布“龙虾卫士”,护航OpenClaw智能体安全落地
2026-03-19 17:10:20
从照相、互联网到VR、AI:为什么总是黄色产业最积极
2025-05-23 18:18:06
重视安全成金字招牌,报告称 Anthropic 持续成功挖角谷歌及 OpenAI 高层
2025-06-05 14:52:04
《智能家居产业标准化工作路线图》发布
2026-03-12 15:49:48
拿什么管住狂奔的AI? “十五五”规划下,AI安全千亿级市场正在开启
2025-10-29 15:00:01
Claude Code砸的坑,蚂蚁安全在尝试填上
2026-07-13 15:18:15
Hinton突然对AGI乐观了!“Ilya让他看到了什么吧…”
2025-09-04 15:01:08
翁荔离职OpenAI后第一个动作:万字长文探讨RLHF的漏洞,网友们抢着传看
2024-12-02 17:55:35
OpenAI前首席科学家Ilya创立新公司,瞄准超越AGI的“超级人工智能”和绝对的AI安全
2024-06-21 01:08:25
独家解读丨为什么是 Virtue AI?揭秘 Meta 收购华人 AI 安全团队始末
2026-07-14 13:07:28
马斯克深夜挥刀,Grok幕后员工1/3失业
2025-09-15 08:50:18
772 文章
866067 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30