待验证50% 置信观点精确时间
Qwen2.5-3B-Instruct、Phi-3.5-mini(3.8B)和Llama-3.2-3B-Instruct是2024年末在小参数规模上综合表现最优的三款模型
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/16
首次发现
有效期至:2026/10/14
来源
相关事实
待验证Qwen 3.6 35B A3B在长上下文记忆基准测试中相比Gemma 4和Qwen 3.5具有明显优势75% 相似已验证Qwen3.6 35B-A3B是混合专家架构(MoE),总参数量35B,每次推理实际激活参数量约3B72% 相似待验证Qwen3(千问3)在Ollama上提供0.6B/1.7B/4B/8B等多种规格71% 相似待验证Qwen2.5-72B 在多项基准测试中接近 Llama-3.1-405B 的表现70% 相似待验证如果 Gemma 3 12B 在结构化输出上频繁出错,建议换用 Qwen 2.5 系列或 Llama 3.1 8B/70B,因为它们对 Function Calling 有更好的原生支持70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/533258API
curl https://kongchang.com/api/v1/knowledge/claims/533258MCP
get_claim(id=533258)