Unverified50% confidenceFactExact time
语言模型的提示缓存(prompt caching)机制会缓存已发送的消息,从而无需反复重新处理相同内容
1
Sources
50%
Confidence
Long-term
Relevance
9/11/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedPrompt Caching缓存的是输入而非输出,缓存LLM的输出几乎没有意义77% similarUnverified语义缓存(Semantic Caching)技术通过判断新查询与历史查询的语义相似度,在满足条件时直接返回缓存结果以避免重复计算73% similarUnverified缓存读取(Cache Read)是指模型在多轮对话或重复调用中直接从缓存读取已解析上下文的中间计算结果,无需重新处理71% similarUnverified提示词缓存技术将KV矩阵存储在高速内存中,当下一次请求包含相同前缀内容时直接读取缓存跳过重算70% similarUnverifiedKV Cache机制可以缓存重复的前缀内容,越简洁的系统提示词缓存命中率越高68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/902397API
curl https://kongchang.com/api/v1/knowledge/claims/902397MCP
get_claim(id=902397)