待验证60% 置信事实时间未知
通义零码(Qwen Coder)采用专家混合架构(MoE),拥有4800亿总参数,推理时仅激活350亿参数
2
来源数
60%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
Qwen Code CLI实测:阿里开源AI编码代理安装配置全指南
bilibiliAI-seeker
涉及实体
相关事实
部分验证Qwen 3 Max和DeepSeek-V3均采用MoE架构,总参数量达数千亿,但实际推理激活参数仅为总量的一小部分78% 相似已验证Qwen3-235B总参数量为2350亿,采用MoE架构,每次前向推理实际激活的参数量约22B77% 相似待验证小米MiMo采用混合专家(MoE)架构,总参数量为24.6B,每次推理仅激活约5.3B参数76% 相似已验证Gemma 4的26B MOE模型采用混合专家架构,拥有260亿总参数但任意时刻仅约40亿参数处于激活状态75% 相似待验证Hy3采用混合专家(MoE)架构,总参数量达2950亿(295B),每次推理仅激活210亿(21B)参数74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/23558API
curl https://kongchang.com/api/v1/knowledge/claims/23558MCP
get_claim(id=23558)