Unverified50% confidenceFactExact time
Tiny-MoE模型总参数量约200M,但每个token激活的参数仅约90M
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
15岁少年从零训练200M MoE语言模型:完整架构与实战拆解
redditr/learnmachinelearning7/12/2026
Related Claims
Unverified对于 198B 总参数的稀疏 MoE 模型,实际激活参数量可能仅为 20-40B 量级83% similarUnverified分析推测该模型是2到4万亿参数规模的MoE模型,每个Token仅激活约1500亿参数74% similarUnverified轻量小模型通常指参数量在1亿以下的BERT系列模型,如DistilBERT、TinyBERT71% similarUnverified1000亿参数的模型处理单次推理请求需约80GB显存,百亿参数级别模型仅需约20GB70% similarUnverified目前Cursor调用的模型上下文长度仅为20万token69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/501380API
curl https://kongchang.com/api/v1/knowledge/claims/501380MCP
get_claim(id=501380)