待验证50% 置信事实精确时间
Token 缓存(Prompt Caching)是大模型 API 中的成本优化机制,当同一段前缀在多次请求中重复出现时可缓存计算结果并收取更低费用
1
来源数
50%
置信度
长期有效
时效性
2026/9/30
首次发现
来源
涉及实体
相关事实
待验证缓存输入是指将相同上下文预存在服务端,后续请求复用缓存无需重复计算,按更低价格收费79% 相似已验证提示词缓存(Prompt Caching)机制可复用相同前缀上下文的 KV Cache,通常可节省 50%~90% 的输入 token 成本79% 相似待验证缓存命中(cache hit)是大语言模型API中的一种计费优化机制,费率通常仅为普通输入Token的1/4甚至更低79% 相似待验证Anthropic的Prompt Caching功能对请求中的固定前缀部分若能复用缓存,则对相应Token给予折扣77% 相似已验证API计费中输出Token的单价普遍高于输入Token,因为生成过程需要逐Token自回归推理76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/962545API
curl https://kongchang.com/api/v1/knowledge/claims/962545MCP
get_claim(id=962545)