Unverified50% confidenceFactTime unknown
GLM5.1相比GLM5在编程能力(Coding Evaluation)测评数据上有显著提升
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
GLM5.1编程能力实测:从零构建全栈AI画布应用全过程
bilibili神秘的鱼仔
Related Claims
UnverifiedGLM 5.1的核心优势在于测试覆盖率碾压全场,在三道题中均表现出最强的测试代码生成能力76% similarVerifiedGLM-5.2采用了基于执行反馈的强化学习(RLEF),将代码能否通过测试作为奖励信号优化生成可执行代码的能力75% similarUnverifiedGLM-5.2在HumanEval、MBPP等主流编码基准测试中表现突出74% similarUnverifiedGLM 5.2在实现和完成任务方面表现完美,代码生成与任务闭环能力强71% similarUnverified配置智谱GLM模型后,Claude Code验证测试显示使用的是GLM-5.1模型67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/60708API
curl https://kongchang.com/api/v1/knowledge/claims/60708MCP
get_claim(id=60708)