待验证50% 置信事实精确时间
订阅版的缓存TTL可保温一小时,而API调用模式默认五分钟过期
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/2
首次发现
有效期至:2026/12/1
来源
涉及实体
相关事实
待验证Anthropic 的 Prompt Caching API 要求缓存前缀至少达到1024个 token,缓存有效期通常为5分钟,在活跃会话中可自动续期71% 相似待验证L1缓存命中延迟约为4-5个周期,而寄存器访问为零延迟68% 相似待验证首字延迟(TTFT)指从用户发出请求到模型输出第一个 token 之间的时间间隔,主要受制于 prefill 阶段耗时68% 相似待验证中心化API(如OpenAI)的首Token延迟(TTFT)通常在200-500毫秒之间67% 相似待验证一次AI API调用的延迟包括网络往返时间(50-200ms)、服务端排队、模型推理首Token延迟(TTFT,通常500ms-3s)及逐Token流式输出时间67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/842323API
curl https://kongchang.com/api/v1/knowledge/claims/842323MCP
get_claim(id=842323)