Unverified50% confidenceFactExact time
Self-Refine(Madaan等,2023)让模型生成初始输出后以批评者身份评估并给出改进建议再重新生成
1
Sources
50%
Confidence
Long-term
Relevance
7/20/2026
First Seen
Sources
Related Claims
Unverified自我反思通过让模型评估自身输出质量并迭代改进来实现,Reflexion框架展示了Agent可以从失败尝试中学习并在下一轮迭代中调整策略69% similarUnverified设计师可以在原型的特定部分进行标注并提出修改意见,模型会据此迭代更新67% similarUnverified2024年中期推理模型首次上线时用户反馈简单问题等待过久,催生了自动路由机制65% similarUnverified激活修补由Meng等人在2022年的ROME论文中广泛推广,其原理是将一次运行中某层的激活值移植到另一次运行中观察输出变化,从而进行因果推断65% similarUnverified宪法AI框架让模型依据预定义的原则列表对自身输出进行批判与修订,再通过RLHF进一步优化65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/572478API
curl https://kongchang.com/api/v1/knowledge/claims/572478MCP
get_claim(id=572478)