Unverified50% confidenceFactExact time
Prompt Cache机制中,当API请求前缀内容与之前相同时系统复用已计算的KV缓存以更低价格完成缓存读取,缓存写入是首次将内容写入缓存时的计费项
1
Sources
50%
Confidence
Long-term
Relevance
7/10/2026
First Seen
Sources
GPT-5.6三模型架构解析:Sol/Terra/Luna定价与性能全览
bilibiliDP_IT7/9/2026
Related Claims
UnverifiedAnthropic 的 prompt caching 功能允许对重复出现的系统提示或代码文件进行缓存以降低输入 Token 成本76% similarUnverified前缀缓存(Prefix Caching)技术通过将已计算的KV向量持久化存储在服务端,当新请求与之前请求存在大量重复前缀时可直接复用,匹配部分按缓存价格计费75% similarUnverifiedvLLM的前缀缓存(Prefix Caching)对KV Cache块计算哈希值,当新请求输入前缀与已缓存请求重叠时直接复用物理缓存块,跳过该部分prefill计算75% similarUnverifiedKV Cache(键值缓存)机制使得共享相同前缀的API请求可以复用已计算的Key和Value向量,从而大幅降低推理成本74% similarUnverifiedAnthropic的提示缓存(Prompt Caching)利用Transformer架构中的KV Cache机制,通过缓存共享提示前缀对应的键值状态来降低延迟和成本72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/452333API
curl https://kongchang.com/api/v1/knowledge/claims/452333MCP
get_claim(id=452333)