《科创板日报》30日消息,华为发布参数规模达7180亿的新模型——盘古Ultra MoE,该模型全流程基于昇腾AI计算平台训练。华为同步发布了盘古Ultra MoE的模型架构与训练方法技术报告。在训练方法上,华为首次在昇腾CloudMatrix 384超节点上实现大稀疏比MoE强化学习后训练框架,推动RL后训练进入超节点集群时代。此外,近期推出的盘古Pro MoE大模型(参数量720亿,激活160亿参数量)于2025年5月的大模型榜单SuperCLUE中,位列千亿参数量以内国内榜首。
原文链接
本文链接:https://kx.umi6.com/article/19522.html
转载请注明文章出处
相关推荐
换一换
华为徐直军:全球最强超节点今年四季度上市
2025-09-18 10:51:41
以软件补硬件:华为定档 11 月 21 日发布并开源创新 AI 容器技术 Flex:ai
2025-11-19 00:47:08
华为董事侯金龙:全球AIDC装机规模将持续突破
2026-05-18 22:01:24
华为推出首个服务基层医院端云协同智慧病理解决方案
2026-02-01 10:32:41
华为将于3月20日发布数据存储新品
2026-03-10 16:39:18
华为与深交所联合发布证券行业法规大模型,问答准确率超 90%
2025-11-28 20:47:40
华为发布AI推理技术UCM:降低HBM依赖 计划9月正式开源
2025-08-13 08:39:18
华为面向医疗领域发布 AI 数据平台,涵盖知识生成与检索等
2025-12-07 18:40:26
华为AI软硬件终将崛起 专家:有可能威胁NVIDIA全球霸主地位
2025-10-18 20:38:08
华为发布 AI 推理创新技术 UCM:可实现高吞吐、低时延推理体验,计划 9 月开源
2025-08-12 16:20:29
华为发布以AI-Centric全面升级的AI WAN解决方案
2025-10-15 21:41:25
华为全球悬赏300万元解决AI时代的存储难题
2025-12-26 18:58:07
华为招募全球顶尖 AI 人才,目标打造世界最强 AI
2025-10-21 12:25:50
730 文章
781839 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30