Unverified50% confidenceFactExact time
一个2万亿参数的模型即便使用FP8量化,其权重也高达2TB,每生成一个token就需完整扫描这2TB数据
1
Sources
50%
Confidence
Long-term
Relevance
7/22/2026
First Seen
Sources
Related Claims
Unverified1000亿参数的模型处理单次推理请求需约80GB显存,百亿参数级别模型仅需约20GB69% similarUnverified一个千亿参数级别旗舰模型每次推断所需GPU资源可能比百亿参数模型高出10至20倍69% similarUnverified分析推测该模型是2到4万亿参数规模的MoE模型,每个Token仅激活约1500亿参数67% similarUnverifiedE2B后缀表示Effective 2B,模型总参数量更大但每次推理只激活约20亿有效参数66% similarUnverifiedGrok 1 的3140亿总参数中每次推理仅激活约25%,实际推理算力接近650亿参数规模的密集模型65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/587229API
curl https://kongchang.com/api/v1/knowledge/claims/587229MCP
get_claim(id=587229)