待验证50% 置信注意事项精确时间
LLM存在自信的流畅性(Confident Fluency)倾向,倾向于给出听起来正确的答案而非承认不确定性
1
来源数
50%
置信度
长期有效
时效性
2026/7/16
首次发现
来源
相关事实
待验证LLM评估相比人工更客观,能在统一评估框架下对候选人一致性打分,避免人类面试官因疲劳、心情、首因效应等认知偏差导致的不公69% 相似待验证人类评估者往往对流畅、自信、符合直觉的回答给予更高评分,这是奉承偏差(Sycophancy)的形成根源68% 相似待验证LLM在生成摘要时天然倾向于反映评论中的多数意见,混淆了信息频率与信息重要性67% 相似待验证研究表明RLHF中的人类评估者倾向于偏好更长、更详细、语气更友善的回答,即使这些回答在事实准确性上并不占优66% 相似待验证元认知反馈的奖励机制:对正确答案高置信度给予奖励,对错误答案高置信度给予惩罚,对不确定问题恰当表达犹豫也予以鼓励65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/530619API
curl https://kongchang.com/api/v1/knowledge/claims/530619MCP
get_claim(id=530619)