待验证50% 置信事实精确时间
Reflexion框架让模型评估自己输出的质量并进行迭代修正
1
来源数
50%
置信度
长期有效
时效性
2026/8/20
首次发现
来源
相关事实
待验证自我反思通过让模型评估自身输出质量并迭代改进来实现,Reflexion框架展示了Agent可以从失败尝试中学习并在下一轮迭代中调整策略78% 相似待验证Reflexion算法引入语言层面的自我反思机制,使Agent在每轮循环后生成自然语言评估并注入下一轮上下文77% 相似待验证工具调用允许模型在推理过程中动态调用外部函数,并将执行结果纳入后续推理的上下文,形成感知-决策-执行的闭环69% 相似待验证模型引导(steering)通过在推理过程中直接修改中间层的激活向量,在不修改权重的前提下影响模型输出行为66% 相似待验证评估大模型时应关注其在实际工作流中的真实表现,如理解模糊需求、多轮追问中保持上下文一致、稳定处理不规范输入65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/779032API
curl https://kongchang.com/api/v1/knowledge/claims/779032MCP
get_claim(id=779032)