[KongchangAI]
Unverified50% confidenceBenchmarkExact time

斯坦福大学的AgentBench基准测试(2023年)量化证明,在复杂多步骤任务中纯ReAct范式的成功率往往不超过30%

1
Sources
50%
Confidence
Long-term
Relevance
7/18/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/552253
API
curl https://kongchang.com/api/v1/knowledge/claims/552253
MCP
get_claim(id=552253)