Unverified60% confidenceFactTime unknown
基准测试显示Qwen3-235B的表现追平甚至超越了DeepSeek R1,在数学、编码、推理等类别中均占优势
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
6/3/2026
First Seen
Valid until: 9/1/2026
Sources
Qwen3免费编程实战:搭配Cline打造全栈应用
bilibili4zapi
Related Entities
Related Claims
UnverifiedQwQ-32B在多项主流基准测试中与DeepSeek R1满血版表现几乎持平,部分任务上实现了反超77% similarUnverifiedQwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几73% similarUnverifiedQwen2.5-72B 在多项基准测试中接近 Llama-3.1-405B 的表现73% similarUnverifiedQwen3.6-27B各项基准测试成绩在同规模(20B-30B参数级别)模型中处于领先地位72% similarUnverifiedQwen3.6-27B在多个基准测试维度上全面超越了前代Qwen系列中参数量更大的旗舰模型72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/38235API
curl https://kongchang.com/api/v1/knowledge/claims/38235MCP
get_claim(id=38235)