标题:量化能让大模型“恢复记忆”,删掉的隐私版权内容全回来了
宾夕法尼亚州立大学、哈佛大学及亚马逊团队的一项研究显示,4-bit量化可以让现有反学习/机器遗忘技术失效。即大模型在人类要求下“忘记”特定知识(如版权、私人内容等),但通过量化技术,这些知识能被重新“回忆”起来。
研究发现,量化过程中的微小变化可能使量化后的模型权重与原始模型权重相同,从而恢复遗忘的知识。对此,一些网友感到意外,认为知识似乎在32-bit中被移除,但在压缩至4-bit时重新出现。这表明知识可能从未真正丢失,只是被隐藏。
团队提出了缓解此问题的策略,即通过构建模块级别的显著性图来指导遗忘过程,仅更新与遗忘数据最相关的模型部分,以减少量化后知识恢复的风险。
研究评估了六种有效的反学习方法,结果显示在全精度下,反学习法平均保留21%的目标遗忘知识,但经过4-bit量化后,这一比例上升至83%。这意味着大部分被“遗忘”的知识可通过简单量化操作恢复。
实验在NEWS(BBC新闻文章)和BOOKS(哈利波特系列)等数据集上进行,使用了四个评估指标:逐字记忆、知识记忆、隐私泄露及保留集效用。结果显示,4-bit量化显著恶化了遗忘性能,而8-bit量化的影响较小。
研究人员分析了现有反学习法的问题,发现它们为了保持模型效用而使用较小的学习率和效用约束,导致模型权重变化小,容易在量化过程中映射到相同值,从而恢复遗忘的知识。为此,研究人员提出SURE框架,通过构建模块级显著性图来指导遗忘过程,选择性地使用较大学习率,从而有效防止量化后遗忘知识恢复。SURE策略在全精度模型上实现了可比的遗忘性能和模型效用。
更多细节请参阅原论文和代码:https://arxiv.org/pdf/2410.16454,代码已在GitHub上公开。
原文链接
本文链接:https://kx.umi6.com/article/8834.html
转载请注明文章出处
相关推荐
换一换
北京备案大模型达225款 占全国总量约三成
2026-04-22 20:27:12
微博CEO吐槽Manus能力拉跨:后悔买大模型年费包
2026-08-29 00:36:54
腾讯升级大模型研发架构 前OpenAI顶尖研究员出任首席AI科学家
2025-12-17 18:59:08
美国公司又吹牛!首例AI自主勒索攻击被拆穿:人类幕后操盘、AI只配敲键盘
2026-07-07 17:39:23
中国企业调用大模型日均达37万亿tokens
2026-02-24 13:54:18
智谱AI今日正式上市,一文讲透你想知道的6件事
2026-01-09 21:35:10
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑
2026-08-15 00:36:59
清华孙茂松:对工业界而言,大厂可以Scaling,其他玩家重在垂直应用 | MEET2026
2025-12-21 10:35:20
10万国产卡支持!智谱发布轻量级旗舰模型对标DeepSeek
2026-08-27 00:50:13
刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude
2026-08-03 14:01:23
美图吴欣鸿回应大模型竞争:美图应用数据仍在快速增长
2026-02-05 18:05:31
舔狗AI和被预约的寿司郎
2026-06-05 00:34:31
15元买数百万Token:一句你好烧掉5万
2026-06-18 01:04:32
803 文章
1000474 浏览
24小时热文
更多
-
2026-09-07 10:44:22 -
2026-09-06 21:14:00 -
2026-09-06 20:12:34