待验证88% 置信事实精确时间
根据Google官方数据,Context Caching对于包含大量共享上下文的场景可以将输入Token成本降低最多75%
1
来源数
88%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
Firebase AI Logic五大更新:混合推理、提示词安全与AI监控全解析
twitterFirebase2026/6/1
涉及实体
相关事实
待验证DeepSeek的缓存机制(Context Caching)中,缓存命中的Token通常按原价的十分之一甚至更低计费72% 相似待验证提示词缓存(Prompt Caching)技术已被Anthropic Claude API和Google Gemini API支持,可将长会话成本降低60%~90%71% 相似待验证上下文缓存机制可将需要反复查询同一知识库的企业应用API成本降低60%-80%,部分提供商缓存命中token折扣高达90%69% 相似待验证Gemini的Context Caching功能可以为反复查询的长文件节省高达90%的API调用成本69% 相似待验证通过缓存中间结果、选择性使用高价模型、批量处理请求,可将API调用成本降低30%-70%67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/36421API
curl https://kongchang.com/api/v1/knowledge/claims/36421MCP
get_claim(id=36421)