待验证50% 置信基准精确时间
在Bespoke Labs的流出级评测上,Nimble达到90.12,而其基座模型Qwen 3.5 9B只有66.36
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/10/7
首次发现
有效期至:2027/1/5
来源
涉及实体
相关事实
已验证Qwen3.5的参数激活率为4.3%,而DeepSeek V3的671B模型激活率为5.5%67% 相似待验证Qwen3.5-122B-A10B 在 100 次测试中出现 8 次拒答,KL 散度为 0.085666% 相似待验证在终端基准(Terminal Bench)测试中,Qwen 3.6 27B得分约60.7,而Muse Glimmer只有51.7,明显落后66% 相似待验证Unsloth发布的QWEN 3 235B的1-bit构建宣称保留77%精度,但在长任务上实际得分只有8%66% 相似待验证Qwen2.5-72B 在多项基准测试中接近 Llama-3.1-405B 的表现66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/984297API
curl https://kongchang.com/api/v1/knowledge/claims/984297MCP
get_claim(id=984297)