待验证50% 置信基准精确时间
Qwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/21
首次发现
有效期至:2026/10/19
来源
相关事实
待验证Qwen3.5的参数激活率为4.3%,而DeepSeek V3的671B模型激活率为5.5%79% 相似待验证Qwen3.5在HLE博士级综合题评测中得分28.7,而GPT-5.2为35.577% 相似待验证Qwen 3's flagship version matches or surpasses GPT-4o and Claude 3.5 Sonnet in multiple benchmark tests.77% 相似待验证Qwen3.5在IFBench指令遵循评测中得分76.5,超过GPT-5.2的75.4和Claude 4.5 Opus的5877% 相似待验证Qwen 3.6 35B A3B在长上下文记忆基准测试中相比Gemma 4和Qwen 3.5具有明显优势75% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/583666API
curl https://kongchang.com/api/v1/knowledge/claims/583666MCP
get_claim(id=583666)