Unverified50% confidenceFactExact time
压缩后的输入 token 下降幅度(49.5%)大于总成本下降幅度(35.6%),因为输出 token、缓存及固定开销不会因输入压缩等比例减少
1
Sources
50%
Confidence
Long-term
Relevance
9/18/2026
First Seen
Sources
Related Entities
Related Claims
Unverified更低的 token 消耗意味着更低的直接成本和更短的响应延迟,token 效率反映模型的语义压缩能力76% similarUnverified缓存命中降低的是单次请求的费率,而非Token的绝对消耗量75% similarUnverified某付费竞品skill只减少20%代码量,但Token消耗反而增加7%75% similarUnverified缓存输入Token通常享有原价25%-50%的折扣,因为无需重新计算嵌入和注意力权重,只需从缓存加载预计算的KV向量74% similarVerified/compact 命令可以减少 30% 到 50% 的 Token 消耗74% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/932089API
curl https://kongchang.com/api/v1/knowledge/claims/932089MCP
get_claim(id=932089)