Unverified50% confidenceBenchmarkExact time
在纯推理任务上Qwen3 27B的HLE只有30.8分,明显落后于Opus的40.0分
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/24/2026
First Seen
Valid until: 12/23/2026
Sources
Related Entities
Related Claims
Unverified在终端基准(Terminal Bench)测试中,Qwen 3.6 27B得分约60.7,而Muse Glimmer只有51.7,明显落后71% similarUnverifiedQwen3-235B的MoE版本实际激活参数仅约22B71% similarUnverified作者提到此前测试的35B、3B等其他模型在看板任务上的表现反而不如Qwen3 27B的Q2版本71% similarUnverified研究显示,30B参数模型在复杂推理任务上的成功率比GPT-4/Claude-3.5低15-30个百分点70% similarUnverifiedQwen3.6 34B 80层模型在LM Studio上的MTP推测解码接受率约为78%,而原版27B仅约57-58%69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/947048API
curl https://kongchang.com/api/v1/knowledge/claims/947048MCP
get_claim(id=947048)