待验证50% 置信事实精确时间
上下文缓存允许将已处理长文档前缀的KV缓存保存在服务端复用,部分提供商缓存命中的token折扣高达90%
1
来源数
50%
置信度
长期有效
时效性
2026/7/9
首次发现
来源
GLM-5.2完全使用指南:开源长上下文模型实测评测
bilibili英文白斑马2026/7/4
相关事实
待验证上下文缓存机制可将需要反复查询同一知识库的企业应用API成本降低60%-80%,部分提供商缓存命中token折扣高达90%71% 相似已验证Anthropic的Prompt Caching功能允许将重复出现的长上下文缓存在服务端,缓存token的计费价格仅为标准输入价格的10%69% 相似待验证云端备份的付费订阅通常只保留高频原始数据一定期限(如活动数据仅存90天),长期健康趋势对比需求者要确认历史数据保存策略,避免断档68% 相似待验证Gemini的Context Caching功能可以为反复查询的长文件节省高达90%的API调用成本68% 相似待验证提示词缓存(Prompt Caching)机制通常可节省 50%~90% 的输入成本67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/331735API
curl https://kongchang.com/api/v1/knowledge/claims/331735MCP
get_claim(id=331735)