Unverified50% confidenceFactExact time
在MoE模型中稠密层参数量占比通常不到总参数的20%,但每个token都必须经过,因此需要更高精度保护
1
Sources
50%
Confidence
Long-term
Relevance
9/10/2026
First Seen
Sources
Related Entities
Related Claims
VerifiedMoE架构每次推理时通常仅激活总参数的10%-20%75% similarVerified混合专家架构(MoE)在推理时仅激活约10%-30%的总参数量,显著降低单次推理的FLOPs和显存占用74% similarUnverifiedMoE模型的总参数量与激活参数量之间通常相差10-30倍74% similarUnverified参数量在1亿以下的轻量模型经领域数据微调后可达95%以上意图分类准确率,单次推理延迟控制在5-20ms以内71% similarVerifiedAWQ的核心洞察是只有约1%的显著权重对模型输出影响巨大,对其保护性处理可在极低比特宽度下维持模型质量70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/891415API
curl https://kongchang.com/api/v1/knowledge/claims/891415MCP
get_claim(id=891415)