Unverified70% confidenceFactTime unknown
测试中约1-2B的小模型无法在大段系统提示词中准确定位并完成复杂工具调用任务
1
Sources
70%
Confidence
Medium-term (~90 days)
Relevance
6/3/2026
First Seen
Valid until: 9/1/2026
Sources
从Cursor系统提示词看Function Calling与MCP工作原理详解
bilibili荒野芯智观察
Related Claims
Unverified大模型在单次推理中处理的工具越多,工具选择的准确率往往越低,即工具混淆问题74% similarUnverified基准饱和指当模型性能提升到一定程度后,基准测试不再能够有效区分不同模型之间的能力差异73% similarUnverified独立只读评审智能体发现了若干问题,包括原始势能公式未包含软化项、两个预设未做质心系变换、仿真速率依赖显示刷新率等71% similarUnverified工具的动作要幂等,错误要明确,否则模型调用失败后无法补救70% similarUnverified编程场景对模型能力要求极高,弱模型与强模型在代码生成上的表现相差数个数量级,同一编码任务弱模型经过数十次尝试仍无法解决,而强模型第一次运行即可通过编译。69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/40468API
curl https://kongchang.com/api/v1/knowledge/claims/40468MCP
get_claim(id=40468)