待验证85% 置信事实时间未知
在SWE Bench Verified榜单上,Qwen3.6 35B取得了73.4%的成绩
1
来源数
85%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
Qwen3.6 35B开源实测逼近Claude,xAI语音克隆API正式上线
bilibili硅基米德AI
涉及实体
相关事实
待验证Qwen3.6 27B 在 SWE-bench Verified 上拿到77.2分78% 相似待验证Qwen3.6 35B在SWE Bench Verified上的成绩距离Claude Opus 4.6仅差1.6个百分点77% 相似待验证在终端基准(Terminal Bench)测试中,Qwen 3.6 27B得分约60.7,而Muse Glimmer只有51.7,明显落后76% 相似待验证Qwen3.5在IFBench指令遵循评测中得分76.5,超过GPT-5.2的75.4和Claude 4.5 Opus的5873% 相似部分验证Claude Haiku 4.5在SWE-bench基准测试中取得了73.3%的得分73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/17984API
curl https://kongchang.com/api/v1/knowledge/claims/17984MCP
get_claim(id=17984)