Unverified50% confidenceFactExact time
上下文缓存允许将已处理长文档前缀的KV缓存保存在服务端复用,部分提供商缓存命中的token折扣高达90%
1
Sources
50%
Confidence
Long-term
Relevance
7/9/2026
First Seen
Sources
GLM-5.2完全使用指南:开源长上下文模型实测评测
bilibili英文白斑马7/4/2026
Related Claims
Unverified上下文缓存机制可将需要反复查询同一知识库的企业应用API成本降低60%-80%,部分提供商缓存命中token折扣高达90%71% similarVerifiedAnthropic的Prompt Caching功能允许将重复出现的长上下文缓存在服务端,缓存token的计费价格仅为标准输入价格的10%69% similarUnverified云端备份的付费订阅通常只保留高频原始数据一定期限(如活动数据仅存90天),长期健康趋势对比需求者要确认历史数据保存策略,避免断档68% similarUnverifiedGemini的Context Caching功能可以为反复查询的长文件节省高达90%的API调用成本68% similarUnverified提示词缓存(Prompt Caching)机制通常可节省 50%~90% 的输入成本67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/331735API
curl https://kongchang.com/api/v1/knowledge/claims/331735MCP
get_claim(id=331735)