Unverified50% confidenceFactExact time
GLM4在World of AI基准测试工具中排名第五
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
GLM4开源旗舰实测:前端开发碾压Claude等商业模型
bilibiliAI-seeker6/21/2026
Related Claims
UnverifiedGLM-5在SWE-Bench Verified基准测试中得分77.8%,位于开源第一梯队78% similarUnverifiedGLM-4.7是一款MOE(混合专家)架构模型,总参数量达358B(3580亿)73% similarUnverifiedGLM4在SWE-Bench基准测试中得分46.2%,显著优于上一代模型73% similarUnverifiedGLM5.2在前端开发能力测试排名中仅次于飞博5(Firebolt 5),位居前列71% similarUnverifiedGLM 4.6在HumanEval、MBPP、SWE-bench等代码评测基准以及MMLU、GPQA等综合能力基准上的表现对齐Claude 3.4和Claude 3.4.571% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/40630API
curl https://kongchang.com/api/v1/knowledge/claims/40630MCP
get_claim(id=40630)