2026年7月5日,阿里巴巴与清华大学合作论文入选AI顶会ICML杰出论文,获奖率仅千分之一。该研究首次揭示扩散大语言模型(dLLM)的“灵活性陷阱”:在处理数学、编程等推理任务时,dLLM的“任意顺序生成”会使模型绕过逻辑难点,导致“熵退化”并降低推理性能。为此,团队提出极简方案“JustGRPO”,在强化学习训练中放弃任意顺序,强制模型从左向右生成。该方法不仅规避了复杂的工程难题,更在GSM8K测试集上达到89.1%的准确率,全面超越现有专为dLLM设计的复杂算法,成功刷新扩散模型推理纪录。
原文链接
本文链接:https://kx.umi6.com/article/36855.html
转载请注明文章出处
相关推荐
换一换
何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升
2025-06-12 17:40:43
智源推出全能视觉生成模型 OmniGen:支持文生图、图像编辑等
2024-10-29 16:33:28
DiT突遭怒喷,谢赛宁淡定回应
2025-08-20 17:19:58
挑战扩散自回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改
2026-05-13 23:00:53
跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026
2025-12-12 12:47:17
扩散语言模型写代码!速度比自回归快10倍
2025-07-10 17:26:44
VAE再被补刀!清华快手SVG扩散模型亮相,训练提效6200%,生成提速3500%
2025-10-28 15:54:58
GAN已死?GAN万岁!布朗康奈尔新作爆火,一夜碾压扩散模型
2025-01-11 17:39:16
谢赛宁新作:VAE退役,RAE当立
2025-10-14 17:20:36
小众架构赢麻了!通过编辑功能让100B扩散模型飙出892 tokens/秒的速度!
2026-02-11 10:10:31
港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026
2026-03-20 16:52:29
材料设计重大突破!微软发布创新大模型,准确率提升10倍!
2025-01-17 16:19:05
刚刚,OpenAI发布sCM提升50倍效率,扩散模型重大技术突破!
2024-10-25 10:40:17
746 文章
979872 浏览
24小时热文
更多
-
2026-08-20 18:43:40 -
2026-08-20 18:42:09 -
2026-08-20 18:40:35