1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

10月21日,阿里云在韩国首尔举办的SOSP 2025会议上推出全新AI计算解决方案“Aegaeon”。该方案通过Token级别虚拟化GPU访问,实现多模型共享单个GPU的精细化资源调度,大幅降低硬件浪费。测试显示,在服务数十个720亿参数大模型时,所需NVIDIA H20 GPU数量从1192个降至213个,削减82%。系统通过显存管理、KV缓存优化等技术将模型切换开销降低97%,支持亚秒级响应。目前,该技术已应用于阿里云百炼平台,显著降低大型模型服务商的硬件采购成本。

原文链接
本文链接:https://kx.umi6.com/article/27022.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
阿里云为什么「重构自己」?
2026-05-21 16:50:26
阿里云将设立首个AI全球能力中心 并在马来西亚、菲律宾新增数据中心
2025-07-02 10:36:15
英伟达 GPU 用量削减 82%!阿里云打造“AI 性能压榨魔鬼”,213 张卡干 1192 张卡的活
2025-10-18 17:35:54
两个月斩获微软四笔订单 “英版甲骨文”或计划明年IPO
2025-10-16 00:43:21
阿里云:真武芯片超节点已成功适配Qwen3.8,上线百炼提供推理服务
2026-07-23 15:50:49
阿里Q4财报出炉:云外部收入猛增40% AI业务年化收入358亿
2026-05-13 18:49:48
国产GPU领军企业壁仞科技成功登陆香港交易所
2026-01-03 19:24:24
阿里云:采购寒武纪15万片GPU的消息不实,寒武纪股价跳水
2025-09-01 11:16:19
阿里云百炼官宣通义千问3-Max模型降价
2025-11-13 23:26:41
扎克伯格:我们的慈善机构无需更多实验室与人员,“只想要 GPU”
2025-11-11 20:24:38
马年4大顶流模型会师阿里云Coding Plan开工!Token量大管饱,自由切换真香
2026-02-26 00:01:12
Solidigm 成立 AI 中央实验室,H200、B200 GPU 模拟真实工作负载
2025-10-11 10:07:14
英伟达 GPU 用量削减 82%!阿里云打造“AI 性能压榨魔鬼”,213 张卡干 1192 张卡的活
2025-10-18 17:35:54
24小时热文
更多
扫一扫体验小程序