待验证50% 置信基准精确时间
ReAct 在 HotpotQA 等多跳问答任务上比单独 CoT 提升约 10-20 个百分点
1
来源数
50%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
本地Gemma 3 12B变身AI Agent实战指南:工具调用与框架选择
redditr/aiagents2026/7/12
相关事实
待验证在HotpotQA等多跳推理基准上,ReAct相比Act-only方案的任务完成率提升约10-15个百分点,同时幻觉率显著降低78% 相似已验证ReAct论文通过在HotpotQA、FEVER等多跳推理基准上的实验,证明相比单纯的Chain-of-Thought推理,ReAct在需要外部信息检索的任务上准确率提升了约10%~30%73% 相似待验证相比纯 CoT 推理,ReAct 在需要信息检索的问答任务上错误率降低约 34%67% 相似待验证在从50%到92%的准确率提升中,REPL贡献最大(直接从50%跳至74%),随后领域知识注入、模糊搜索、公式追踪、系统prompt优化和bug修复层层累积66% 相似待验证原始论文在HotpotQA、Fever等多跳推理基准上的实验表明,ReAct相比纯CoT将幻觉率降低了约34%65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/502472API
curl https://kongchang.com/api/v1/knowledge/claims/502472MCP
get_claim(id=502472)