待验证50% 置信事实精确时间
MoE架构由 Google Brain 于 2017 年提出,GPT-4、Mixtral 8x7B 等知名模型均采用该架构
1
来源数
50%
置信度
长期有效
时效性
2026/7/11
首次发现
来源
智谱GLM-5.2全量开放,AI监管风暴同步来袭
bilibili黑鸦Heya2026/6/13
相关事实
已验证混合专家架构(MoE)由Google Brain于2017年在Transformer框架下规模化应用,核心思想是将模型参数分组为多个专家子网络,每次推理仅激活其中一小部分73% 相似已验证Google在2017年的Sparsely-Gated MoE论文中系统化了混合专家架构设计73% 相似待验证MoE架构最早由Google在2017年提出,后被Mistral的Mixtral系列和阿里的Qwen系列等广泛采用72% 相似待验证MoE架构由多个专家子网络和一个路由器组成,路由器根据输入token动态选择少数几个专家参与计算,DeepSeek V2/V3、Mixtral 8x7B、Google Gemini 1.5均采用这一架构72% 相似待验证MoE架构由Google 2017年的论文奠基,通过路由网络将Token动态分配给少数专家子网络,Qwen 3.5 122B总参数122B但每次推理仅激活约22B68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/486910API
curl https://kongchang.com/api/v1/knowledge/claims/486910MCP
get_claim(id=486910)