待验证50% 置信事实精确时间
激活参数描述的是每个 token 的计算量,而非权重的存储需求
1
来源数
50%
置信度
长期有效
时效性
2026/7/21
首次发现
来源
相关事实
待验证以7B参数模型为例,每增加1K Token 的上下文约消耗 0.5~1 GB 显存68% 相似待验证上下文越长,模型需要缓存的 KV Cache 越大,KV Cache 使模型生成新 Token 时无需重新计算所有历史 Token 的注意力权重61% 相似待验证FP16格式下,大模型显存需求的估算公式为:参数量 × 2 = 所需显存(GB),即每个参数以16位(2字节)浮点数存储61% 相似待验证对于典型 7B 参数模型,每 1K token 的 KV Cache 约需 0.5–1GB 显存60% 相似待验证大模型调用的计费单位是Token而非请求次数,响应时间从毫秒级变为秒级甚至分钟级59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/577409API
curl https://kongchang.com/api/v1/knowledge/claims/577409MCP
get_claim(id=577409)