正文:11月20日,蚂蚁集团宣布开源万亿参数强化学习高性能权重交换框架Awex。该框架专为解决RL训练中权重参数同步问题设计,可在秒级完成TB级大规模参数交换,显著降低训练延迟。其主要特点包括极速同步性能(千卡集群6秒内全量同步)、统一模型适配、零冗余传输、多模式传输支持及异构部署兼容等。Awex由WeightWriter、WeightReader和MetaServer三大组件构成,核心功能模块涵盖训推权重转换、元数据计算与交换、P2P传输计划及NCCL/RDMA传输。在千卡集群上,使用RDMA传输1TB模型权重仅需6秒。目前,Awex已支持Megatron和SGLang引擎,并计划未来开源ASystem的其他核心RL组件,进一步完善强化学习生态。
原文链接
本文链接:https://kx.umi6.com/article/28770.html
转载请注明文章出处
相关推荐
换一换
腾讯混元再引强将,庞天宇即将入职多模态模型团队负责强化学习前沿算法探索
2026-01-30 15:35:19
蚂蚁通用 AI 助手灵光闪应用升级,最快 30 秒“手搓”一个闪游戏
2025-12-04 12:21:05
杭州蚂蚁投了家腾讯系具身智能公司
2025-11-23 23:26:16
真正的AI竞争力,藏在大模型“后训练”这一步
2025-10-13 16:59:55
无需外部数据!AI自问自答实现推理能力进化
2025-08-08 16:13:47
蚂蚁开源万亿参数强化学习高性能权重交换框架Awex
2025-11-20 10:23:09
马斯克亲自点名Karpathy迎战Grok 5!别神话LLM,AGI还要等十年
2025-10-20 15:08:42
蚂蚁集团旗下公司等入股烨知芯科技 后者经营范围含集成电路芯片设计等
2025-09-03 14:50:33
大厂AI新战场:AQ狂飙,蚂蚁押注大健康赛道
2025-11-09 16:34:57
蚂蚁投了一家上海具身智能公司
2026-02-10 16:23:42
GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道
2025-10-20 16:09:01
攻克强化学习「最慢一环」!交大字节联手,RL训练速度飙升2.6倍
2025-09-13 17:30:05
DeepSeek登《Nature》封面,梁文锋带队,首次回应争议
2025-09-18 13:54:10
745 文章
958905 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47