Unverified50% confidenceFactExact time
混合专家架构(MoE)的思路源于1991年的学术研究,近年被Mistral、DeepSeek、Google(Gemini 1.5)等广泛采用
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
Claude Code国内使用指南:模型选型与省钱配置全攻略
bilibili小伍不是码牛7/7/2026
Related Claims
VerifiedGoogle在2017年的Sparsely-Gated MoE论文中系统化了混合专家架构设计72% similarUnverifiedMoE概念最早由Jacobs等人于1991年提出,谷歌2017年将其规模化至语言模型,Mistral的Mixtral系列将稀疏MoE带入开源社区71% similarUnverifiedMoE架构由多个专家子网络和一个路由器组成,路由器根据输入token动态选择少数几个专家参与计算,DeepSeek V2/V3、Mixtral 8x7B、Google Gemini 1.5均采用这一架构71% similarVerified混合专家架构(MoE)由Google Brain于2017年在Transformer框架下规模化应用,核心思想是将模型参数分组为多个专家子网络,每次推理仅激活其中一小部分69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/501863API
curl https://kongchang.com/api/v1/knowledge/claims/501863MCP
get_claim(id=501863)