1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

11月5日,华为宣布开源其AI推理加速关键技术——UCM(Unified Cache Manager)推理记忆数据管理。该技术通过KV Cache多级缓存与推理记忆管理,结合推理框架、算力和存储的三层协同,解决长序列推理效率低和成本高的问题。UCM架构包含稀疏化模块、稀疏化KV管理器、KV Cache存储组件及UCM连接器等关键模块,具备稀疏注意力、前缀缓存等四大能力,最高可降低首Token时延90%,提升系统吞吐22倍,并扩展上下文窗口达10倍。目前,UCM已在ModelEngine社区开放源代码与技术文档,开发者可通过GitCode或Github获取资源。

原文链接
本文链接:https://kx.umi6.com/article/27844.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
京东云开源JoyAgent智能体
2025-07-26 10:36:52
开源Qwen凌晨暴击闭源Claude!刷新AI编程SOTA,支持1M上下文
2025-07-23 09:45:56
中国AI 大厂,被Deepseek 掀了牌桌之后
2025-05-19 13:16:00
昆仑万维宣布开源 Matrix-Game 大模型:工业界首个开源的 10B+ 空间智能大模型,支持《我的世界》
2025-05-13 10:47:25
百度正式开源文心大模型 4.5 系列模型
2025-06-30 11:41:55
兑现承诺!马斯克旗下xAI宣布Grok 2.5正式开源
2025-08-25 16:33:11
上传一张图、主演任何视频,“性能最强动作生成模型”阿里通义万相 Wan2.2-Animate 开源
2025-09-19 15:14:57
字节 Seed 开源统一多模态理解和生成模型 BAGEL
2025-06-03 19:01:17
蚂蚁发布并开源万亿参数思考模型Ring-1T
2025-10-14 17:25:02
超越 GPT-5 Nano,阿里通义 Qwen3-VL 系列全新成员 4B 与 8B 模型开源上线
2025-10-15 13:33:22
GOSIM AI Paris 2025圆满收官!80+位全球大咖共探模型前沿、算力挑战与落地路径
2025-05-21 09:58:44
4位图灵奖得主布道,2大冠军机器人登台,“AI春晚”果然又高又硬
2025-06-06 22:39:37
小红书开源首个大模型 预训练未使用合成数据
2025-06-10 09:46:30
24小时热文
更多
扫一扫体验小程序