待验证50% 置信事实精确时间
GLM 5.2在Post Train Bench测试中得分34.3分,领先GPT的28.4分,但落后于Opus的37.2分
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
GLM 5.2与Zcode实测:每天500万Token免费AI编程工具深度体验
bilibiliNixAI2026/6/18
相关事实
待验证GLM 5.2在Terminal Bench测试中得分81分,GLM 5.1得分63.5分,GPT 5.5得分84分,Opus 4.8得分85分80% 相似待验证GLM 5.2的Diff测试分数从GLM 5.1的18分跃升至46.2分70% 相似待验证GLM4在SWE-Bench基准测试中得分46.2%,显著优于上一代模型70% 相似待验证顶级PhD专家在Troubleshooting Bench上的得分约为36%,GPT 5.5即时版的得分仅略低于此69% 相似待验证Terminal Bench 2.1测试中GPT-5.6 Ultra得分接近92%,Fable 5为88%,考虑误差范围基本持平69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/43921API
curl https://kongchang.com/api/v1/knowledge/claims/43921MCP
get_claim(id=43921)