待验证50% 置信事实精确时间
工具混乱是开源模型的普遍规律,Kimi模型和MiniMax模型也存在同样问题
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/6
首次发现
有效期至:2026/10/4
来源
给开源模型加「修复层」:DeepSeek也能超越Claude Opus
bilibiliGelai_AI2026/7/5
相关事实
待验证Ahmad Awais提出了一个被称为「工具混乱(Tool Confusion)」的确定性模式,认为开源模型的问题不在模型本身而在工具调用层73% 相似待验证模式坍缩是生成模型领域的经典难题,指模型对同一开放性问题反复给出高度雷同的答案67% 相似待验证LLM网关面临泄漏抽象问题,模型能力的本质差异会泄漏到上层,如system prompt格式、temperature参数语义、function calling调用规范差异66% 相似待验证同样的Tool Confusion修复逻辑可以推广应用于Kimi等其他开源模型65% 相似待验证Meta的LLaMA和微软的Phi系列开源小模型证明精心设计的小模型在特定任务上可接近大模型表现65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/113575API
curl https://kongchang.com/api/v1/knowledge/claims/113575MCP
get_claim(id=113575)