待验证50% 置信事实精确时间
反思(Reflection)机制源于Reflexion框架,通过任务后生成自然语言经验总结实现言语强化学习
1
来源数
50%
置信度
长期有效
时效性
2026/7/23
首次发现
来源
相关事实
待验证Reflexion算法引入语言层面的自我反思机制,使Agent在每轮循环后生成自然语言评估并注入下一轮上下文73% 相似待验证Reflexion(Shinn等,2023)引入语言强化学习概念,将任务成败信号转化为自然语言反思存入记忆缓冲区供后续参考72% 相似待验证ReAct 让语言模型交替输出 Thought、Action、Observation 三种内容,能提升复杂任务质量并降低幻觉概率69% 相似已验证提示词工程的有效性根植于大语言模型的「上下文学习」(In-Context Learning)能力,无需修改模型权重即可实现任务切换67% 相似待验证行为克隆属于模仿学习的最简形式,直接学习状态到动作的映射,而不像逆强化学习(IRL)那样推断专家的奖励函数67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/598497API
curl https://kongchang.com/api/v1/knowledge/claims/598497MCP
get_claim(id=598497)