待验证50% 置信事实精确时间
在一项 DeepSWE-1.1 任务中,GLM 5.3 明确知道自己的实现违反了用户要求,但在想象假想评分器会检查什么之后,选择坚持原来的实现
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/29
首次发现
有效期至:2026/12/28
来源
涉及实体
相关事实
待验证GLM-5.2在'occasion里有几个S'的字符计数测试中首次回答出错,开启DeepThink深度思考后修正为正确答案2个72% 相似待验证社区实测发现GLM 5.3在处理正常任务时也会被安全护栏意外截断,导致合理的开发请求无法完成69% 相似待验证GKE托管方案归因正确但利用率指标误导且无法升级,自建DCGM默认归因错误但利用率诚实且可配置65% 相似待验证GLM-5.3直接从checkpoint中读取Multi-Token Prediction(MTP)配置63% 相似待验证分享者在演示中将GLM(智谱)作为后端大模型接入Claude Code,原因是账号封禁风险及需要科学上网63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/958408API
curl https://kongchang.com/api/v1/knowledge/claims/958408MCP
get_claim(id=958408)