待验证50% 置信概念精确时间
Reflexion算法引入语言层面的自我反思机制,使Agent在每轮循环后生成自然语言评估并注入下一轮上下文
1
来源数
50%
置信度
长期有效
时效性
2026/7/20
首次发现
来源
相关事实
待验证Reflexion框架让模型评估自己输出的质量并进行迭代修正77% 相似待验证反思(Reflection)机制源于Reflexion框架,通过任务后生成自然语言经验总结实现言语强化学习73% 相似待验证Reflexion(Shinn等,2023)引入语言强化学习概念,将任务成败信号转化为自然语言反思存入记忆缓冲区供后续参考72% 相似待验证自我反思通过让模型评估自身输出质量并迭代改进来实现,Reflexion框架展示了Agent可以从失败尝试中学习并在下一轮迭代中调整策略69% 相似待验证ReAct将推理与行动结合,让模型在轨迹中交替生成自然语言推理步骤和具体行动,使错误可被追踪和纠正68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/574181API
curl https://kongchang.com/api/v1/knowledge/claims/574181MCP
get_claim(id=574181)