Unverified50% confidenceBenchmarkExact time
MoE架构中Mixtral 8x7B模型总参数46.7B,但每个token仅激活约12.9B参数(2个专家),推理成本接近13B参数的稠密模型,性能可媲美70B级别
1
Sources
50%
Confidence
Long-term
Relevance
9/6/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedMistral AI的Mixtral 8x7B采用MoE架构,总参数量约47B,但每次推理实际激活的参数仅约13B77% similarUnverified在MoE模型中每个token只激活少量Expert(通常2-4个,Top-K路由),实际计算量可能仅相当于6-7B的Dense模型77% similarVerifiedMixtral 8x7B模型拥有8个专家,每个Token只激活2个,总参数量达到47B,但单次推理的计算量仅相当于一个13B参数的稠密模型76% similarUnverifiedMoE模型中'35B'指总参数量,每个token只激活少量Expert(通常2-4个),实际计算量可能仅相当于6-7B的Dense模型75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/864754API
curl https://kongchang.com/api/v1/knowledge/claims/864754MCP
get_claim(id=864754)