待验证50% 置信事实精确时间
Agent系统由于循环推理特性,每次工具调用后会将完整对话历史重新发送给模型,导致Token消耗呈现超线性增长
1
来源数
50%
置信度
长期有效
时效性
2026/9/9
首次发现
来源
涉及实体
相关事实
待验证模型每次响应会将完整对话历史(上下文窗口)计入计费,随着对话轮次增加,单次调用的Token消耗会呈线性甚至超线性增长80% 相似待验证Agent经过拆解规划后可能触发数十次LLM推理调用,累计Token消耗可达直接问答场景的数十倍77% 相似待验证智能体在每轮循环中需要将系统提示词、历史对话、工具描述、先前步骤的全部输出重新打包送入模型,导致token消耗随步骤数线性甚至超线性增长76% 相似待验证在多轮对话中,每一轮新回复生成前系统都需将此前所有对话历史重新输入模型,导致token消耗随轮次累积增长76% 相似待验证大语言模型每次调用的费用与输入token数量正相关,在Agent循环中随着对话历史积累每次调用成本会线性增长74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/882582API
curl https://kongchang.com/api/v1/knowledge/claims/882582MCP
get_claim(id=882582)