AI芯片厂商Cerebras的CEOAndrewFeldman透露,公司因运行DeepSeek-R1大语言模型的订单过多而面临压力。DeepSeek-R1的预训练成本仅为主流模型的十分之一,且效果更好,被视作AI领域的分水岭。该模型部署在晶圆级AI芯片上,性能显著优于GPU。Cerebras采用蒸馏技术将大型模型的知识转移到小型模型,以提高用户体验。尽管有人担忧成本下降会导致市场萎缩,但历史表明降低成本反而能扩大市场容量。Cerebras自去年8月起提供公共推理服务,目前主要提供蒸馏后的70B模型,未来可能提供更多选择。
原文链接
本文链接:https://kx.umi6.com/article/13239.html
转载请注明文章出处
相关推荐
换一换
DeepSeek专家模式无法上传文件 官方提示:目前资源紧张
2026-05-14 16:48:15
Anthropic正在洽谈使用微软的AI芯片
2026-05-21 22:05:03
DeepSeek启动首次外部融资?最新消息来了
2026-04-18 22:26:47
DeepSeek又崩了
2026-03-31 18:01:07
机构:预估到2030年全球半导体产业市场规模或达1.5万亿美元
2026-05-26 16:41:31
DeepSeek开招土木老哥:自建GW级数据中心
2026-06-09 11:12:33
DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开
2026-07-08 13:08:19
刚刚,DeepSeek V4 系列更新,架构没变,Agent 能力为何大涨
2026-07-31 17:43:16
DeepSeek V4价格打骨折,宁王京东网易抢着入场,梁文锋:目标是AGI
2026-05-23 18:53:19
英伟达游戏业务被边缘化 玩家吐槽被抛弃
2026-04-19 21:23:46
三星电子市值达万亿美元 成台积电之后第二家达到该规模的亚洲公司
2026-05-06 09:09:51
华泰证券:硅光技术有望成为全新增长极 关注半导体代工企业发展机会
2026-05-21 08:29:26
DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了
2026-08-18 10:40:58
748 文章
906996 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47