4月3日,谷歌更新Gemini API定价策略,按推理使用需求分档计费。新增五个档位:标准、弹性、优先、批量和缓存版。弹性档位利用闲置算力,提供五折优惠,延迟1至15分钟,无延迟保证;批量档位同样五折,延迟最长24小时。缓存档位按Token数量与存储时长计费,适合复杂指令对话、长视频分析及大规模文档查询场景。优先档位价格比标准高出75%-100%,延迟控制在毫秒至秒级,适用于实时客服、欺诈检测等关键业务场景。
原文链接
本文链接:https://kx.umi6.com/article/34432.html
转载请注明文章出处
相关推荐
换一换
从1纳秒到2天:你的系统延迟“合理”吗?
2024-07-13 16:11:10
谷歌:Gemini API 用量 6 个月飙升 14 倍,明年将升级 AI 助手
2024-10-31 15:56:03
消息称因 AI 回答不靠谱,亚马逊 Alexa 升级版将推迟上线
2025-02-16 08:18:05
草稿链代替思维链,推理token砍掉80%,显著降低算力成本和延迟
2025-03-11 14:31:21
太初元碁携手上海人工智能实验室举办AI4S和新型模型架构算子优化赛
2026-07-23 10:38:05
上海这场大赛有点“野”:让AI自主科研、控核聚变、认甲骨文
2026-07-23 09:36:06
阿里Qoder上线全新安全能力,为每位用户配备一位专属安全工程师
2026-07-21 14:07:01
逛了趟WAIC,我只想说,AI在物理世界都快卷疯了……
2026-07-19 20:33:38
危!GPT-5.6会自动删文件,AI初创老板痛失整台Mac
2026-07-19 18:26:13
不靠英伟达网卡,国产GPU直通方案实测出炉:吞吐飙升、延迟砍半
2026-07-19 20:35:20
AI语音进入“表演时代”:阿里Qwen-Audio-3.0-TTS登顶全球权威榜单
2026-07-20 18:23:12
2.9 Exaflops全液冷巨兽!AMD首套AI机架Helios亮相:向NVIDIA发起全面挑战
2026-07-21 11:04:04
天立启鸣发布教育AGI白皮书:破解教育“不可能三角”
2026-07-22 12:58:38
739 文章
828729 浏览
24小时热文
更多
-
2026-07-24 12:36:48 -
2026-07-24 11:35:13 -
2026-07-24 10:33:39