待验证50% 置信事实精确时间
14B MoE模型的代码能力保留了95.9%,损失仅约4%
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Qwen3.6非官方衍生模型:34B深度扩展与14B极致压缩解析
bilibiliAI观模者2026/6/21
相关事实
待验证开发者最终选择KL散度最低(0.028)的变体,GSM8K下降1.83%,MMLU保持不变,HarmBench合规率从30.8%提升至100%65% 相似待验证14B MoE模型基于Qwen3.6 35B MoE压缩而来,总参数从35B压缩到14B,但每次激活参数仍为3B,与原版35B完全一致62% 相似待验证14B MoE模型是越狱版本,KLD(与原模型的差距指标)仅为0.0015(约0.15%)61% 相似待验证OmniMerge V4在MBPP代码测试中达到73.4%,相比原版Q6K量化的56.2%提升了15.8个百分点61% 相似待验证Ling-3.0-flash 采用混合专家(MoE)架构,激活比例仅约4%(124B总参数中激活约5.1B)60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/40893API
curl https://kongchang.com/api/v1/knowledge/claims/40893MCP
get_claim(id=40893)