Unverified50% confidenceFactExact time
反馈循环指模型预测影响用户行为、用户行为又成为下一轮训练数据形成闭环,处理不当会放大偏差并造成模型自我强化的恶性循环
1
Sources
50%
Confidence
Long-term
Relevance
9/1/2026
First Seen
Sources
Related Entities
Related Claims
Unverified用户的点赞、纠错、重试、改写等行为本质上是隐式偏好信号,能持续校准模型的输出分布77% similarVerified奖励模型的训练可使用Bradley-Terry模型等排序学习框架,训练神经网络预测任意两个回答之间的人类偏好概率,接收(prompt, response)对并输出标量分数72% similarUnverified自回归生成模型在每一步基于前文概率分布采样下一个 token,当某种重复模式获得略高概率后会形成正反馈循环导致重复退化72% similarUnverified自我反思通过让模型评估自身输出质量并迭代改进来实现,Reflexion框架展示了Agent可以从失败尝试中学习并在下一轮迭代中调整策略71% similarUnverified领先模型若被用于生成训练数据,可能将自身偏差系统性地传递给下一代,即'模型坍塌'风险71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/834041API
curl https://kongchang.com/api/v1/knowledge/claims/834041MCP
get_claim(id=834041)