2026年2月,蚂蚁集团发布LLaDA2.1扩散语言模型,实现892 tokens/秒的峰值速度,显著超越主流自回归模型。该模型采用双模式解码策略:极速模式适合高吞吐场景,质量模式保障高精度任务。通过可纠错编辑机制,模型先并行生成草稿再全局修正,解决了扩散模型的逻辑一致性问题。此外,团队首次在100B参数规模上成功应用强化学习,大幅提升指令遵循等任务表现。开源版本包括100B和16B两种规模,后者峰值速度超1500 tokens/秒,为轻量化部署提供支持。技术报告及代码已公开。
原文链接
本文链接:https://kx.umi6.com/article/32840.html
转载请注明文章出处
相关推荐
换一换
英伟达合作推出 Fast-dLLM 框架,AI 扩散模型推理速度最高飙升 27.6 倍
2025-06-03 12:54:51
跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026
2025-12-12 12:47:17
全球首个Agentic扩散模型来了:边行动边纠错,128K上下文追平自回归
2026-07-28 12:57:42
何恺明带大二本科生颠覆扩散图像生成:扔掉多步采样和潜空间,一步像素直出
2026-02-02 16:48:05
突破瓶颈!北航ETH等首次将扩散模型完全量化至1bit,28倍存储节省+52.7倍效率提升
2025-01-11 12:37:26
MSRA:视觉生成六大技术问题
2024-07-13 12:09:52
跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026
2025-12-12 12:47:17
ViT一作盛赞:这个中国开源“PS模型”强过Nano Banana
2025-12-29 13:21:05
智源推出全能视觉生成模型 OmniGen:支持文生图、图像编辑等
2024-10-29 16:33:28
扩散模型还原被遮挡物体,几张稀疏照片也能”脑补”完整重建交互式3D场景|CVPR’25
2025-04-23 13:56:19
AI视频边生成边播放!首帧延迟仅1.3秒,生成速度9.4帧/秒|Adobe&MIT新研究
2024-12-10 15:56:19
12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看
2025-05-22 15:30:59
谷歌 Fluid 颠覆共识:两大因素被发现,AI 文生图领域自回归模型超越扩散模型
2024-10-23 14:39:38
750 文章
963235 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47