待验证60% 置信基准精确时间
Mixtral 8x7B总参数约46.7B,每次前向传播仅激活约12.9B参数,推理计算量比同等性能密集模型降低约60%
2
来源数
60%
置信度
长期有效
时效性
2026/7/12
首次发现
来源
AI数据中心抢电:美国制造业能源成本为何持续飙升
hackernewshackernews2026/7/7
相关事实
已验证Mistral的Mixtral 8x7B模型通过稀疏激活机制,每次推理仅激活8个专家中的2个,以约13B参数的计算成本达到接近Llama 2 70B的性能水平74% 相似待验证Mixtral 8x7B等MoE模型实现了接近70B模型的效果,却只需约13B模型的推理成本73% 相似待验证领域微调后的7B模型在任务准确率上往往超越未经微调的70B通用模型,同时推理成本降低一个数量级70% 相似待验证DistilBERT将参数量压缩至6600万(原版1.1亿),推理速度提升60%,精度损失不足3%69% 相似待验证算子融合优化对于12层BERT模型通常可带来30%~60%的额外加速64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/489066API
curl https://kongchang.com/api/v1/knowledge/claims/489066MCP
get_claim(id=489066)