待验证50% 置信事实精确时间
在多轮对话中,之前所有上下文都会作为输入重新发送,因此早期生成的冗余代码会在后续每一轮对话中持续产生 token 成本
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Ponytail插件:让AI编程Agent写最少代码的极简哲学
bilibiliNixAI2026/6/20
相关事实
待验证上下文窗口机制导致多轮对话中模型需将所有对话历史送入上下文,使Token消耗随对话变长而快速增长77% 相似待验证长对话会将整个上下文历史打包重新发送给模型,并计入每次请求的Token用量,对话越长单次请求消耗Token越多77% 相似待验证Chat Memory通过在每次请求中将历史消息注入Prompt来模拟记忆,导致Token消耗随对话轮次线性增长76% 相似待验证在Cursor中一次Tab补全可能消耗数千个输入Token用于构建上下文,而纯对话场景不会产生这种隐性成本72% 相似待验证API计费同时涵盖输入Token和输出Token,随着对话延伸,每次请求携带的输入Token会线性增长72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/43668API
curl https://kongchang.com/api/v1/knowledge/claims/43668MCP
get_claim(id=43668)