待验证85% 置信事实时间未知
GLM-4.6在推理模式下工具调用失效,评测团队不得不禁用推理模式才能让其正常运行
1
来源数
85%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
Haiku 4.5 vs GPT-5 Mini vs GLM-4.6:低价编程模型实测对比
bilibiliAI-seeker
涉及实体
相关事实
待验证GLM-5.2在'occasion里有几个S'的字符计数测试中首次回答出错,开启DeepThink深度思考后修正为正确答案2个67% 相似待验证GLM系列采用自回归填空训练目标(Autoregressive Blank Infilling),通过对文本片段随机遮蔽并要求模型自回归还原64% 相似待验证绝大多数LLM评测工具只在答案已经呈现给用户之后才进行打分,无法实时拦截错误输出62% 相似待验证GLM-4.6在内存中追踪活跃任务,应用程序崩溃后所有状态会丢失61% 相似待验证Zig核心贡献者指出即使不考虑LLM问题,Bun的并行语义分析补丁也不会被接受,因为这是一个长期规划的功能60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/24425API
curl https://kongchang.com/api/v1/knowledge/claims/24425MCP
get_claim(id=24425)