4月7日消息,谷歌联合卡内基梅隆大学和MultiOn的研究团队发现,合成数据可使大模型数学推理能力提升八倍。当前全球高质量文本训练标记约300万亿个,但随着大模型需求激增,预计2026年前将耗尽这些数据,合成数据成为关键替代方案。研究团队探索了正向数据(正确解题示例)与负向数据(错误解题步骤)两种类型。正向数据虽能提供解题参考,但可能导致模型过度依赖模式匹配而非深入理解。负向数据则通过直接偏好优化(DPO)方法帮助模型识别并修正错误,增强逻辑推理能力。DPO为每一步骤分配优势值,强调关键步骤价值。测试显示,结合正向和负向合成数据预训练后,DeepSeek-Math-7B和LLaMa2-7B等模型在GSM8K和MATH数据集上的数学推理性能显著提升八倍,展现了合成数据的巨大潜力。
原文链接
本文链接:https://kx.umi6.com/article/16764.html
转载请注明文章出处
相关推荐
换一换
Manus救不了Meta
2026-01-08 20:35:12
WAIC信息爆炸!大佬们都在说什么,笔记看这里
2026-07-18 12:23:17
大模型也得「睡觉」了:Google 的这篇论文,戳中了AI 的最大软肋
2026-07-23 12:47:10
国家网信办:利用合成数据进行模型训练和关键能力优化时 应当评估合成数据安全性
2025-12-27 15:42:08
Gartner首次发布大模型报告:火山引擎排名中国厂商第一
2025-11-20 12:17:36
刚刚,智谱港交所敲钟!市值528亿港元
2026-01-08 11:04:01
“雷军千万年薪要挖”的 DeepSeek 罗福莉官宣加入小米 Xiaomi MiMo 大模型团队
2025-11-12 14:05:32
花几百万买的H100在「摸鱼」?英伟达:别怪显卡,是你的模型「长得丑」
2026-07-23 18:00:12
持续霸榜!阿里千问3.6Plus问鼎全球大模型调用周榜冠军
2026-04-07 12:52:26
上海已发布超150款备案大模型
2026-03-28 20:16:44
备案平均时长缩至2个月 目前已有216款大模型在京完成备案
2026-02-28 19:46:01
全球首份大模型业绩报!MiniMax预判2026三大超级PMF,AI平台公司启程了
2026-03-03 11:54:49
北京备案大模型达225款 占全国总量约三成
2026-04-22 20:27:12
720 文章
778101 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30