待验证90% 置信事实时间未知
在SaaS仪表盘测试中,GLM 4.7的Token消耗仅23,000,远低于Gemini和Claude
1
来源数
90%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
前端UI生成实测:GLM 4.7、Claude Opus、Gemini、Minimax谁最强?
bilibiliGoldenSpiderAI
涉及实体
相关事实
待验证GLM 4.7和Minimax M2.1的费用不到Claude Opus 4.5的1/25,却在多个任务中取得了更好的结果72% 相似待验证在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内65% 相似待验证在 Frontiers-WE 基准上,GLM-5.2 与 Claude Opus 4.8 的差距缩小到不足一分62% 相似待验证M2.7在SWE-bench Pro基准测试中得分56.22%,超过了Gemini 3.1 Pro61% 相似待验证Gemma 4 31B 在评测中超越了智谱 GLM、DeepSeek V3.2 等同参数量级模型,并与 Gemini 5、Kimi 2.5 等大模型表现相当61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/20496API
curl https://kongchang.com/api/v1/knowledge/claims/20496MCP
get_claim(id=20496)