Unverified60% confidenceFactTime unknown
Qwen 3's flagship version matches or surpasses GPT-4o and Claude 3.5 Sonnet in multiple benchmark tests.
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Related Claims
UnverifiedQwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几77% similarUnverifiedQwen3.5在IFBench指令遵循评测中得分76.5,超过GPT-5.2的75.4和Claude 4.5 Opus的5874% similarUnverifiedQwen3.5在AIME 2026数学竞赛评测中得分91.3,GPT-5.2为96.771% similarUnverifiedQwen3.6-27B在多个基准测试维度上全面超越了前代Qwen系列中参数量更大的旗舰模型71% similarUnverifiedQwen3.5在HLE博士级综合题评测中得分28.7,而GPT-5.2为35.570% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/54883API
curl https://kongchang.com/api/v1/knowledge/claims/54883MCP
get_claim(id=54883)