待验证50% 置信事实精确时间
Ling-3.1-flash采用混合专家(MoE)架构,总参数量约为5600亿(~560B)
1
来源数
50%
置信度
长期有效
时效性
2026/9/30
首次发现
来源
涉及实体
相关事实
已验证盘古2.0 Flash采用MoE(混合专家)架构,参数规模为92B A6B(总参数92B,激活参数6B)70% 相似已验证DeepSeek V4 Flash uses a Mixture of Experts (MOE) architecture with a total parameter count exceeding 600 billion (600B+).68% 相似待验证千问3.8 Flash Next额外引入了510亿参数的Ngram模块,类似巨大的局部短语记忆表68% 相似待验证DeepSeek-V4.1-Flash采用552B参数的MoE(混合专家)主干架构67% 相似待验证阿里通义千问正式发布Qwen3.8-Flash-Next(千问308 Flash NEX)模型,总参数高达181.5B67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/962912API
curl https://kongchang.com/api/v1/knowledge/claims/962912MCP
get_claim(id=962912)