待验证50% 置信事实精确时间
OpenAI Prompt Caching 可将重复前缀的缓存成本降至原价的10%-25%
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/21
首次发现
有效期至:2026/10/19
来源
相关事实
待验证OpenAI于2024年推出Prompt Caching功能,当提示词前缀完全相同且超过1024 token阈值时复用KV Cache,缓存部分通常按原价25%甚至更低计费78% 相似待验证OpenAI引入提示缓存断点机制,允许开发者手动指定缓存断点,缓存命中部分计费通常可打折至原价的10%~25%76% 相似待验证通过缓存中间结果、选择性使用高价模型、批量处理请求,可将API调用成本降低30%-70%76% 相似已验证Anthropic的Prompt Caching功能允许将重复出现的长上下文缓存在服务端,缓存token的计费价格仅为标准输入价格的10%76% 相似待验证缓存定价对重复输入内容给予折扣,在Agent反复调用场景中能大幅降低实际成本74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/582191API
curl https://kongchang.com/api/v1/knowledge/claims/582191MCP
get_claim(id=582191)