【2023年2月2日】私募巨头幻方量化旗下新组织"深度求索"宣布采用上下文硬盘缓存技术,旨在优化大模型API的使用效率。该技术将预估需重复使用的数据存储于分布式硬盘阵列,以减少不必要的计算过程。在具体应用中,当输入内容重复时,只需从缓存中读取,无需重新计算,此举有望使大模型成本降低一个数量级。目前,缓存命中部分的费用设定为每百万tokens 0.1元。这一创新策略不仅提高了大模型的运行效率,也为降低成本开辟了新路径。
原文链接
本文链接:https://kx.umi6.com/article/4481.html
转载请注明文章出处
相关推荐
换一换
幻方量化旗下DeepSeek发布V2.5模型
2024-09-06 18:17:45
英伟达的最大空头出现了
2024-12-31 15:46:07
DeepSeek等大模型集体“打标”,从此告别AI造假?
2025-09-02 17:35:56
幻方量化相关人士回应“DeepSeek-R2 模型提前发布”:以官方消息为准
2025-02-26 08:21:28
中央网信办总工程师孙蔚敏:国内数十家大模型厂商已在政务领域展开探索
2024-05-24 23:19:47
幻方量化旗下大模型厂商启用硬盘缓存技术 大模型价格再降一个数量级
2024-08-02 22:07:33
爱奇艺:AI 已成为内部成熟的生产力,将推出 AI 少儿内容专项扶持政策
2025-12-19 23:15:22
日本富山县计划建设日本最大的数据中心枢纽
2025-12-19 14:56:05
亲手给AI投毒之后,我觉得整个互联网都变成了一座黑暗森林
2025-12-19 12:48:52
中央网信办:加强网络生态治理 营造清朗网络空间
2025-12-19 09:40:50
谷歌帮你揪出 AI 视频,Gemini 新增 AI 生成内容检测功能
2025-12-19 16:58:43
微软、谷歌等24家公司加入美国政府的人工智能“创世使命”
2025-12-19 03:23:09
内存涨价背后:AI存储正在「吃掉」手机、PC
2025-12-19 10:43:24
625 文章
362833 浏览
24小时热文
更多
-
2025-12-20 12:49:52 -
2025-12-20 11:47:38 -
2025-12-20 09:39:29