待验证50% 置信事实精确时间
2023年UC Berkeley研究团队在论文中证实,主流奖励模型存在显著的长度偏见,在内容质量相同情况下更长回答系统性获得更高奖励分数
1
来源数
50%
置信度
长期有效
时效性
2026/8/22
首次发现
来源
涉及实体
相关事实
待验证人类标注者在评估答案时存在信息越丰富越好的认知偏差,导致奖励模型将篇幅与质量隐性挂钩,是模型冗余的成因之一68% 相似待验证莱顿宣言和旧金山科研评估宣言(DORA)的批评者指出,现有评价体系系统性地奖励短平快的增量研究,惩罚耗时长、风险高的原创探索66% 相似待验证研究发现用户偏好可能倾向于更长、格式更精美的回答,即所谓的verbose bias或长度偏差66% 相似待验证Gao et al.(2023)的研究发现随着策略模型对奖励模型的优化程度增加,真实人类偏好评分先升后降呈现倒U形曲线65% 相似待验证元认知反馈通过奖励置信度与准确率的一致性,在奖励信号中引入认知诚实度这一与内容质量正交的新维度65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/786691API
curl https://kongchang.com/api/v1/knowledge/claims/786691MCP
get_claim(id=786691)