1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

标题:免训练大模型知识编辑,吸收新数据更高效|EMNLP’24

让大模型能快速、准确、高效地吸收新知识!

EMNLP 2024收录的一项新研究提出了一种检索增强的连续提示学习新方法,提高知识终身学习的编辑和推理效率。此方法旨在纠正大语言模型中的过时或错误知识,而不需昂贵的再训练过程。

此前工作多集中在单次或批量编辑,但由于灾难性遗忘和模型性能下降,这些方法在终身编辑场景中表现不佳。基于检索的方法虽有所改善,但仍面临知识整合缓慢的问题。

最新方法名为RECIPE,它将知识描述转化为简短且信息丰富的连续提示的token表示,作为LLM输入查询嵌入的前缀,优化知识编辑过程。此外,RECIPE引入了知识哨兵机制,动态判断检索库是否包含相关知识。

RECIPE通过联合训练检索器和提示编码器,确保知识编辑的可靠性、通用性和局部性。实验结果显示,RECIPE在多个权威模型和数据集上的表现优于其他方法。

这项研究由阿里安全内容安全团队与华东师范大学计算机科学与技术学院及阿里云计算平台合作完成。

研究背景指出,大语言模型如ChatGPT在保持事实准确性和逻辑一致性方面面临挑战。编辑模型以纠正不准确之处,而不进行大规模再训练,是亟待解决的问题。

模型方法部分介绍了任务定义和评估属性,RECIPE通过构造和更新知识检索仓库、基于知识哨兵的动态提示检索、以及动态编辑模型的推理,实现了高效编辑。

实验结果表明,RECIPE在单次和终身编辑场景中均表现出色,尤其是在通用能力和编辑效率方面。与其他方法相比,RECIPE不仅减少了编辑时间,还保持了模型的原始推理速度。

原文链接
本文链接:https://kx.umi6.com/article/8000.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
很多成功人士容易犯的一个错误 !周鸿祎点破了
2025-08-06 16:35:55
思科全球创新主管迪德里希:AI 时代学生应该接触哲学和伦理学等人文学科
2025-11-10 15:19:36
AI时代,普通人的9个升维认知
2025-03-04 16:23:20
WAIC 2026|智象未来发布全球首个无限时长内容创作智能体——vivago R1
2026-07-20 14:15:54
苹果iOS 27开发者预览版Beta 4发布:国行iPhone期待的Siri AI继续缺席
2026-07-21 06:51:16
《LOL》Bin大小姐短片爆红!性转Bin哥被Zeus拥入怀
2026-07-22 17:10:36
成本直降 90%!原来 Kimi K3 叠 Claude Code 还能这么玩
2026-07-23 12:51:59
美国开源AI实验室Arcee表示:中国模型没有危险性 但会威胁美国闭源模型的利润空间
2026-07-23 15:52:51
微软又给Windows找了个塞Copilot的地方:文件管理器新增快捷按钮
2026-07-22 20:13:24
世界模型迎来「中国引领时刻」,昆仑万维 Matrix-Game 3.5 要迈向真实世界
2026-07-23 12:45:29
国内首个!阿里健康氢离子达成NEJM、JAMA、BMJ三大医学顶刊内容合作
2026-07-21 15:10:45
花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」
2026-07-23 18:00:12
WAIC 2026 | 摩尔线程首次公开多项训练推理实践成果,三大“AI工厂”持续释放算力价值
2026-07-19 15:15:47
24小时热文
更多
扫一扫体验小程序