1月27日,国产GPU厂商曦望在杭州发布新一代推理GPU芯片启望S3及超节点方案、推理云计划。这是曦望完成约30亿元融资后的首次技术亮相。与行业普遍的‘训推一体’路线不同,S3专注于推理效率和单位成本,采用LPDDR6显存方案,显存容量提升4倍,单位Token推理成本下降约90%。曦望还推出面向大模型推理的寰望SC3超节点解决方案,支持单域256卡互联,交付成本从亿元级降至千万元级,并兼容CUDA软件体系。此外,曦望联合生态伙伴探索推理云平台,通过GPU池化与弹性调度降低企业使用门槛,推动‘百万Token一分钱’目标实现。董事长徐冰表示,持续降低推理成本是掌握AI产业成本曲线的关键。
原文链接
本文链接:https://kx.umi6.com/article/32244.html
转载请注明文章出处
相关推荐
换一换
AI推理GPU芯片公司曦望完成近30亿元融资
2026-01-22 16:05:02
新国产GPU「曦望」,刚融了10个亿
2025-06-30 18:45:32
国内首家百亿估值纯推理GPU独角兽诞生!专访曦望联席CEO王湛:谁的推理成本更低谁就是赢家
2026-04-23 23:33:29
巨简单,更懂家!海信JUOS正式发布:行业首个家庭智能伴侣级AIOS
2026-09-02 10:24:20
在接下来70%的人生里 我可能都要问“是AI做的吗?”
2026-09-03 01:00:11
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
2026-09-04 18:32:46
趋境科技与摩尔线程达成战略合作,高品质 AI Token 国产异构方案性价比超越国际先进算力
2026-09-04 18:34:16
自进化WAM来了!清华AIR联手域变换提出具身In-Context Causal Learning
2026-09-01 13:36:24
GitHub最热架构图Agent,开发者故事看哭了
2026-09-01 16:48:05
Coding不再是程序员专属!阿里Qoder这波有点绝
2026-08-29 21:17:36
DLSS 5太吃性能 双显卡玩游戏重出江湖!一卡渲染、一卡计算
2026-09-04 19:35:53
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
2026-09-03 17:33:12
DeepSeek Harness 的插件体验短板:安全权限未生效,好插件用户找不到
2026-09-01 16:51:10
710 文章
873269 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47