已过期60% 置信事实精确时间
GLM4在World of AI基准测试工具中排名第五
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30(已过期)
来源
GLM4开源旗舰实测:前端开发碾压Claude等商业模型
bilibiliAI-seeker2026/6/21
相关事实
待验证GLM-5在SWE-Bench Verified基准测试中得分77.8%,位于开源第一梯队78% 相似待验证GLM-5.3在六项评测中的成绩为:终端编程基准3.0得28.3、深度软件工程基准得66.9、智能体中场考试得28.5、自动化基准得48.2、带工具的人类终极考试得62.5、GDP价值评估AA2版得17.6976% 相似待验证GLM-5.3在Agents' Last Exam基准上达到开源模型SOTA成绩73% 相似待验证GLM-4.7是一款MOE(混合专家)架构模型,总参数量达358B(3580亿)73% 相似待验证GLM4在SWE-Bench基准测试中得分46.2%,显著优于上一代模型73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/40630API
curl https://kongchang.com/api/v1/knowledge/claims/40630MCP
get_claim(id=40630)