待验证50% 置信事实精确时间
MoE 模型每次推理时只激活一小部分专家子网络,Naive-N0.5-Flash 实际推理时只有约 5% 的参数在工作
1
来源数
50%
置信度
长期有效
时效性
2026/9/28
首次发现
来源
涉及实体
相关事实
已验证混合专家架构(MoE)在推理时仅激活约10%-30%的总参数量,显著降低单次推理的FLOPs和显存占用80% 相似已验证MoE架构每次推理时通常仅激活总参数的10%-20%78% 相似待验证MoE 模型每个 token 只被路由到少数几个专家进行计算,使总参数量大但激活参数量小75% 相似待验证混合专家架构(MoE)每次推理只激活全部专家子网络中的一小部分,通常为10-20%74% 相似待验证Pangu 2.0 uses a sparse architecture employing Mixture of Experts (MoE), activating only a subset of parameters per inference rather than all 505 billion72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/957122API
curl https://kongchang.com/api/v1/knowledge/claims/957122MCP
get_claim(id=957122)