待验证50% 置信事实精确时间
Prompt Caching可将公共前缀的KV Cache持久化存储,成本可降至普通输入的10-20%
1
来源数
50%
置信度
长期有效
时效性
2026/8/24
首次发现
来源
涉及实体
相关事实
待验证Prompt Caching通过复用前缀KV Cache,以Anthropic定价为参考可将延迟降低约85%、成本降低约90%79% 相似已验证OpenAI Prompt Caching 可将重复前缀的缓存成本降至原价的10%-25%76% 相似待验证提示词缓存(Prompt Caching)机制可复用相同前缀上下文的 KV Cache,通常可节省 50%~90% 的输入 token 成本74% 相似待验证Anthropic 的 prompt caching 功能使缓存命中的输入 Token 费用降至原价的 10%73% 相似已验证Anthropic的Prompt Caching功能允许将重复出现的长上下文缓存在服务端,缓存token的计费价格仅为标准输入价格的10%72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/795538API
curl https://kongchang.com/api/v1/knowledge/claims/795538MCP
get_claim(id=795538)