待验证50% 置信事实精确时间
大语言模型的输出token通常比输入token贵2-3倍,因为生成过程是自回归的,每次只生成一个token并重新运行前向传播
1
来源数
50%
置信度
长期有效
时效性
2026/7/19
首次发现
来源
相关事实
已验证输出token单价通常高于输入token,因为生成过程需要逐token进行自回归解码79% 相似待验证大语言模型通过自回归生成机制(autoregressive generation)逐token预测下一个输出,天然倾向于生成更完整而非更精简的代码77% 相似待验证大语言模型的推理速度受制于自回归生成的本质,每次只能生成一个token且依赖前序所有token,无法真正并行化73% 相似待验证大语言模型每次调用的费用与输入token数量正相关,在Agent循环中随着对话历史积累每次调用成本会线性增长71% 相似待验证大语言模型的推理过程是自回归的,输出Token数量与响应延迟几乎成线性关系71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/562071API
curl https://kongchang.com/api/v1/knowledge/claims/562071MCP
get_claim(id=562071)