Unverified50% confidenceFactExact time
模型每次响应会将完整对话历史(上下文窗口)计入计费,随着对话轮次增加,单次调用的Token消耗会呈线性甚至超线性增长
1
Sources
50%
Confidence
Long-term
Relevance
7/22/2026
First Seen
Sources
Related Claims
Unverified在多轮对话中,每一轮新回复生成前系统都需将此前所有对话历史重新输入模型,导致token消耗随轮次累积增长83% similarUnverified大语言模型每次调用的费用与输入token数量正相关,在Agent循环中随着对话历史积累每次调用成本会线性增长79% similarUnverified多轮对话的实现方式是每次请求时将之前所有的对话历史全部重新输入给模型,而非模型具有真正的记忆能力76% similarUnverified模型在每次推理时需要将当前对话的完整历史记录一并输入处理,总结全部内容操作会将整个上下文历史计入输入费用75% similarUnverified每次大语言模型对话由系统提示、历史对话和用户输入三部分共同构成模型的输入上下文71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/584993API
curl https://kongchang.com/api/v1/knowledge/claims/584993MCP
get_claim(id=584993)