待验证50% 置信事实精确时间
xAI的Grok-1采用3140亿总参数、每次激活约25%专家的设计
1
来源数
50%
置信度
长期有效
时效性
2026/8/16
首次发现
来源
相关事实
已验证Qwen3-235B总参数量为2350亿,采用MoE架构,每次前向推理实际激活的参数量约22B68% 相似待验证Qwen3.6 35B模型包含256个专家,每个Token仅激活8个路由专家和1个共享专家,实际推理时激活参数约为3B64% 相似待验证Hy3采用混合专家(MoE)架构,总参数量达2950亿(295B),每次推理仅激活210亿(21B)参数63% 相似待验证MAI Thinking-E总参数量约为1T(万亿),激活参数约35B,采用MoE(混合专家)架构63% 相似待验证苹果A18 Pro芯片的Neural Engine峰值算力达到约35 TOPS,足以本地运行30亿至70亿参数量级的压缩语言模型62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/757424API
curl https://kongchang.com/api/v1/knowledge/claims/757424MCP
get_claim(id=757424)