Unverified50% confidenceFactExact time
人类标注者在评估答案时存在信息越丰富越好的认知偏差,导致奖励模型将篇幅与质量隐性挂钩,是模型冗余的成因之一
1
Sources
50%
Confidence
Long-term
Relevance
7/20/2026
First Seen
Sources
Related Claims
Unverified顶级模型在许多评估任务上已接近人类裁判的水平,但存在倾向于给较长回答打高分等偏见77% similarUnverified元认知反馈的奖励机制:对正确答案高置信度给予奖励,对错误答案高置信度给予惩罚,对不确定问题恰当表达犹豫也予以鼓励76% similarUnverified该量表属于自评量表,受被试主观报告倾向影响大;存在掩饰动机或述情障碍的人群测评准确性会明显下降76% similarUnverified元认知反馈通过奖励置信度与准确率的一致性,在奖励信号中引入认知诚实度这一与内容质量正交的新维度75% similarUnverified人类评估者往往对流畅、自信、符合直觉的回答给予更高评分,这是奉承偏差(Sycophancy)的形成根源75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/567988API
curl https://kongchang.com/api/v1/knowledge/claims/567988MCP
get_claim(id=567988)