待验证50% 置信事实精确时间
大语言模型的输出token价格通常是输入的4-8倍,因为输出涉及自回归生成需要多次前向传播,边际成本更高
1
来源数
50%
置信度
长期有效
时效性
2026/8/24
首次发现
来源
涉及实体
相关事实
待验证API调用费用按输入token和输出token分别计价,且输出token的单价通常高于输入token,因为输出阶段需要自回归推理75% 相似待验证LLM中输出token的成本通常是输入token的3-6倍,因为生成需要逐token自回归推理74% 相似待验证输出token通常比输入token更贵,因为输出需要自回归逐token生成,计算密度更高且GPU利用率更低73% 相似待验证输出Token价格通常为输入的4-6倍,源于预填充与解码两阶段的算力差异,解码阶段GPU利用率可能仅为预填充的10-20%73% 相似待验证embedding模型的调用成本通常只有大语言模型生成成本的几十分之一甚至更低71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/794101API
curl https://kongchang.com/api/v1/knowledge/claims/794101MCP
get_claim(id=794101)