待验证60% 置信事实时间未知
GLM 4.6在HumanEval、MBPP、SWE-bench等代码评测基准以及MMLU、GPQA等综合能力基准上的表现对齐Claude 3.4和Claude 3.4.5
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/6/3
首次发现
有效期至:2026/9/1
来源
Claude Code搭配GLM4.6:编程Agent国产化部署指南
bilibili潜龙悟用-
涉及实体
相关事实
待验证GLM-4.7在代码能力基准测试中超过DeepSeek V3.2及Claude Sonnet 4.577% 相似待验证GLM4在代码推理和通用知识测试中得分74.4%,仅次于Claude 3 Opus76% 相似待验证在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内72% 相似待验证GLM-4.7是一款MOE(混合专家)架构模型,总参数量达358B(3580亿)72% 相似待验证智谱GLM系列从GLM4.5到4.7在358B参数规模上连续打磨三代,随后GLM5翻倍至754B71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/38492API
curl https://kongchang.com/api/v1/knowledge/claims/38492MCP
get_claim(id=38492)