Unverified85% confidenceFactTime unknown
GLM-4.6在推理模式下工具调用失效,评测团队不得不禁用推理模式才能让其正常运行
1
Sources
85%
Confidence
Medium-term (~90 days)
Relevance
6/1/2026
First Seen
Valid until: 8/30/2026
Sources
Haiku 4.5 vs GPT-5 Mini vs GLM-4.6:低价编程模型实测对比
bilibiliAI-seeker
Related Entities
Related Claims
UnverifiedGLM-5.2在'occasion里有几个S'的字符计数测试中首次回答出错,开启DeepThink深度思考后修正为正确答案2个67% similarUnverifiedGLM系列采用自回归填空训练目标(Autoregressive Blank Infilling),通过对文本片段随机遮蔽并要求模型自回归还原64% similarUnverified绝大多数LLM评测工具只在答案已经呈现给用户之后才进行打分,无法实时拦截错误输出62% similarUnverifiedGLM-4.6在内存中追踪活跃任务,应用程序崩溃后所有状态会丢失61% similarUnverifiedZig核心贡献者指出即使不考虑LLM问题,Bun的并行语义分析补丁也不会被接受,因为这是一个长期规划的功能60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/24425API
curl https://kongchang.com/api/v1/knowledge/claims/24425MCP
get_claim(id=24425)