Unverified50% confidenceFactExact time
上下文缓存技术底层依赖Transformer的KV Cache机制,前缀相同的Key和Value向量可复用
1
Sources
50%
Confidence
Long-term
Relevance
7/11/2026
First Seen
Sources
Kun开源Agent:为DeepSeek深度优化的国产AI编程助手
bilibili人猿菜山7/7/2026
Related Claims
Unverified主流Transformer架构通过KV Cache机制避免重复计算已处理的Token82% similarUnverified在 Transformer 架构中,KV 缓存一旦提示前段发生变化,其后所有位置的 KV 缓存全部失效需重新计算78% similarUnverifiedLlama.cpp 的 -ngl 参数控制将多少 Transformer 层放到 GPU 显存中运行,若显存不足会自动将放不下的层回退到 CPU 形成混合推理模式68% similarUnverifiedGPU显存中的KV Cache占用与输入Token数量线性相关67% similarUnverified深度递归指对单一输入快照的同一状态执行多轮迭代计算,Universal Transformer、DEQ等架构是代表66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/484699API
curl https://kongchang.com/api/v1/knowledge/claims/484699MCP
get_claim(id=484699)