待验证50% 置信事实时间未知
当给Agent提供100个工具描述时,模型会出现选择困难,甚至幻想出不存在的参数,调用准确率断崖式下降
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Agent开发核心是上下文工程?深度拆解面试高频题
bilibiliArxiv论文
相关事实
待验证当前工具选择策略高度依赖模型的即时判断,缺乏系统性优化,在企业场景中可用工具可达数十乃至数百个,模型选择时易出现幻觉、重复调用或选错工具74% 相似待验证工具设计应遵循动作幂等、错误明确的原则,否则模型调用失败无法恢复,工具描述质量直接决定Agent成败73% 相似待验证Anthropic团队发现Agent框架里编码了太多对模型局限的假设,模型升级后这些假设会过时,导致大量最佳实践失效73% 相似待验证9B级别模型精度不足,会创建函数却不声明、写出空函数,有时工具调用损坏导致Agent无法理解模型意图70% 相似待验证工具描述的精确程度直接决定Agent的任务执行成功率,模糊或歧义的描述是导致工具误调用最常见的根本原因70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/60341API
curl https://kongchang.com/api/v1/knowledge/claims/60341MCP
get_claim(id=60341)