待验证50% 置信事实精确时间
Prompt Caching缓存命中读取仅需基础输入的0.1倍价格,首次写入成本是常规输入的2倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/2
首次发现
有效期至:2026/12/1
来源
涉及实体
相关事实
待验证缓存读取的成本按行业惯例应当只有普通输入token的十分之一左右76% 相似待验证Prompt Caching在提示词前缀完全相同且超过约1024 token阈值时命中,缓存token通常按原价的25%甚至更低计费71% 相似待验证提示词缓存(Prompt Caching)机制通常可节省 50%~90% 的输入成本71% 相似已验证OpenAI Prompt Caching 可将重复前缀的缓存成本降至原价的10%-25%68% 相似待验证提示词缓存(Prompt Caching)机制可复用相同前缀上下文的 KV Cache,通常可节省 50%~90% 的输入 token 成本68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/842320API
curl https://kongchang.com/api/v1/knowledge/claims/842320MCP
get_claim(id=842320)