1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议

5月10日消息,谷歌为其Gemini 2.5 API推出“隐式缓存”功能,自动识别并重用API请求中的常见前缀,使开发者的成本最高降低75%。该功能适用于Gemini 2.5 Pro和Gemini 2.5 Flash模型。与2024年5月发布的“显式缓存”不同,“隐式缓存”无需开发者手动配置,系统默认开启,简化了操作流程。谷歌建议开发者在构建提示词时,将稳定内容置于开头,用户特定变量放于后方以提升缓存命中率。同时,Gemini 2.5 Flash需至少1024个Token,Pro需2048个Token,API响应新增“cached_content_token_count”字段展示缓存Token使用及计费详情。显式缓存仍作为可选方案支持Gemini 2.5及2.0模型,开发者可自定义缓存内容和TTL(默认1小时)。尽管谷歌声称成本节省可达75%,但具体效果还需第三方验证,且可能因使用模式不同而有所差异。

原文链接
本文链接:https://kx.umi6.com/article/18404.html
转载请注明文章出处
分享至
打开微信扫一扫
内容投诉
生成图片
相关推荐
换一换
阿里云百炼宣布DeepSeek-V4-Pro模型隐式缓存降价
2026-04-29 21:43:37
OpenAI「12朝元老」辞职死谏:试错的时代已崩坏!
2026-10-05 21:17:17
NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026
2026-09-30 14:40:02
OpenAI 经历了最漫长的一天
2026-09-29 17:34:30
在校生自研AI机器人攻入微软内部!涉及17万亿条记录、2.5万员工信息
2026-09-30 12:33:08
Arm与NVIDIA携手为智能体AI时 代构建可信的计算底座
2026-09-29 16:30:14
Gemini 4震撼发布,已实现RSI?谷歌80万行内核已被重写
2026-10-01 10:43:13
拆解 WorkBuddy、千问办公和豆包工作,它们其实不是同一种产品
2026-09-30 15:46:10
DeepSeek扩招!弹性计算团队大量HC,尤其需要资深工程师
2026-10-03 16:27:17
消费者根本无路可退:AI泡沫就算破裂 内存也不会降价!
2026-10-01 16:02:52
突发,谷歌关停大批免费Gemini模型!
2026-10-05 21:15:48
李飞飞创业公司被苏姿丰550亿收购!世界模型最大交易落地
2026-09-29 10:02:47
不用切换App了!豆包支持出行服务:一站式搞定订票、打车、导航全流程
2026-09-30 12:34:38
24小时热文
更多
扫一扫体验小程序