待验证50% 置信事实精确时间
Anthropic在Claude系列模型中推出了原生的提示缓存功能,可对重复的前缀Token进行缓存复用,缓存命中可节省高达90%的对应Token费用
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/12
首次发现
有效期至:2026/10/10
来源
AI调用成本优化实战:智能路由与上下文压缩详解
redditr/learnmachinelearning2026/7/11
相关事实
待验证Claude Code结合Anthropic的Prompt Caching机制可节省约80%的Token成本75% 相似待验证Anthropic的Claude API提供Prompt Caching功能,缓存命中时输入价格降低90%69% 相似待验证Anthropic在Claude 3系列中将上下文窗口扩展至200K Token并研发了提示词缓存技术,可将实际账单成本降低50%以上67% 相似待验证Anthropic 的提示词缓存机制基于 KV Cache,可使匹配前缀的输入 token 费用降低约 90%66% 相似待验证Claude的输入Token通常比输出Token便宜约3-5倍,因为生成过程需自回归逐Token推理65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/492635API
curl https://kongchang.com/api/v1/knowledge/claims/492635MCP
get_claim(id=492635)