Unverified50% confidenceFactExact time
千问3.8 Flash Next的稀疏率约为95%,每次推理只动用不到5%的参数
1
Sources
50%
Confidence
Long-term
Relevance
9/2/2026
First Seen
Sources
Related Entities
Related Claims
Unverified业界普遍推测Flash的参数规模大约是Pro的三分之一到二分之一70% similarUnverified参数量在1亿以下的轻量模型经领域数据微调后可达95%以上意图分类准确率,单次推理延迟控制在5-20ms以内70% similarUnverified单条推理通常只能占用GPU SM利用率的5%~15%,而合理的批次大小可将利用率提升至60%~90%69% similarVerified混合专家架构(MoE)在推理时仅激活约10%-30%的总参数量,显著降低单次推理的FLOPs和显存占用67% similarUnverifiedFlash模型每token的推理成本通常比Pro级模型低一个数量级66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/843529API
curl https://kongchang.com/api/v1/knowledge/claims/843529MCP
get_claim(id=843529)