推理性能提升10倍！蚂蚁集团开源业内首个高性能扩散语言模型推理框架dInfer

2025-10-13 18:00:58

虚拟微光

发布在

快讯

阅读：205

10月13日，蚂蚁集团开源了业界首个高性能扩散语言模型推理框架dInfer。在基准测试中，dInfer将扩散语言模型的推理速度提升10.7倍，超越英伟达Fast-dLLM框架；在代码生成任务HumanEval上，单批次推理速度达1011Tokens/秒，首次显著超越自回归模型。扩散语言模型通过“去噪”生成文本，具备高度并行、全局视野等优势，但推理效率长期受限于计算成本高等问题。dInfer通过四大核心模块针对性解决这些瓶颈，支持多种模型优化与评测。在配备8块NVIDIA H800 GPU的节点上，其速度是vLLM运行AR模型的2.5倍。蚂蚁集团表示，dInfer推动扩散语言模型迈向实践高效，邀请全球开发者共同探索AI潜能。

原文链接

本文链接：https://kx.umi6.com/article/26558.html

转载请注明文章出处

dInfer