Unverified50% confidenceBenchmarkExact time
GLM-5.2在HumanEval、MBPP等主流编码基准测试中表现突出
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/6/2026
First Seen
Valid until: 10/4/2026
Sources
美团CatPaw实测:免费GLM-5.2编程工具靠谱吗?
bilibili鲲鹏Talk7/2/2026
Related Claims
UnverifiedGLM 5.1的核心优势在于测试覆盖率碾压全场,在三道题中均表现出最强的测试代码生成能力75% similarUnverified配置智谱GLM模型后,Claude Code验证测试显示使用的是GLM-5.1模型74% similarUnverifiedGLM5.1相比GLM5在编程能力(Coding Evaluation)测评数据上有显著提升74% similarUnverified传统代码评测基准(如HumanEval、MBPP)主要测试模型在孤立函数级别的生成准确率70% similarUnverifiedHumanEval、MBPP、SWE-bench是专门针对代码生成的标准评测集68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/114977API
curl https://kongchang.com/api/v1/knowledge/claims/114977MCP
get_claim(id=114977)