Unverified60% confidenceFactExact time
GLM4在Design Arena排行榜上排名第一,得分约为1300分,超过Claude 3.5和Gemini 1.5 Pro
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
GLM4 Open-Source Flagship Tested: Crushes Claude and Other Commercial Models in Frontend Development
bilibiliAI-seeker6/21/2026
Related Claims
UnverifiedGLM 5.2 achieved approximately 1300 ELO points on the Design Arena leaderboard, surpassing Claude 3.5.72% similarUnverifiedGemini 3.5 Pro在MMLU Pro基准测试中得分89.4分,领先GPT 5.5和Claude67% similarUnverified在综合性能排名中,Kimi K2.5得分64%,排名第五,前四名分别是Gemini 3 Pro(100%)、Claude Opus 4.5 Max(74%+)、GLM 4.7(65%)和GPT-5.2X(65%)65% similarUnverified测试中GLM 5.1综合得分89.3分,排名第一,超过Claude Sonnet 4.6的87.2分64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/40538API
curl https://kongchang.com/api/v1/knowledge/claims/40538MCP
get_claim(id=40538)