Unverified60% confidenceFactExact time
MoE架构在处理每个输入token时只激活一小部分专家子网络,通常为总专家数的1/8到1/16
2
Sources
60%
Confidence
Long-term
Relevance
7/25/2026
First Seen
Sources
Related Claims
VerifiedMoE架构仅激活部分专家网络,通常为总参数量的15-25%82% similarUnverified混合专家架构(MoE)每次推理只激活全部专家子网络中的一小部分,通常为10-20%80% similarUnverifiedMoE的8选2配置意味着8个专家中每次只激活2个,实际计算量仅为密集模型的约四分之一67% similarUnverifiedMoE架构每次推理仅激活少数专家,训练成本相对同等能力稠密模型大幅降低,10B激活1B相比10B稠密模型训练成本低10倍且推理更快63% similarVerifiedMoE架构每次推理时通常仅激活总参数的10%-20%61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/613168API
curl https://kongchang.com/api/v1/knowledge/claims/613168MCP
get_claim(id=613168)