Unverified50% confidenceFactExact time
2023年斯坦福研究显示,在需要连续多步决策的任务中,现有Agent系统的成功率随步骤数呈指数级下降
1
Sources
50%
Confidence
Long-term
Relevance
7/25/2026
First Seen
Sources
Related Claims
Unverified斯坦福研究团队在对早期Agent系统评估中发现,单步5%的错误率在10步任务中可导致超过40%的最终失败率76% similarUnverifiedAgent在多步骤任务中存在错误累积效应,每步95%准确率的十步串联后成功率跌至约60%71% similarUnverified斯坦福大学的AgentBench基准测试(2023年)量化证明,在复杂多步骤任务中纯ReAct范式的成功率往往不超过30%71% similarUnverified2023年多项学术研究显示在模拟对抗性环境中主流目标检测算法的准确率可下降40-80%68% similarUnverified研究表明当ReAct循环超过10步时,模型的任务完成率会出现显著下降68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/612047API
curl https://kongchang.com/api/v1/knowledge/claims/612047MCP
get_claim(id=612047)