待验证50% 置信事实精确时间
研究表明,提供具体反馈性质的奖励比单纯的物质奖励对内在动机的损害更小
1
来源数
50%
置信度
长期有效
时效性
2026/9/20
首次发现
来源
涉及实体
相关事实
待验证元认知反馈的奖励机制:对正确答案高置信度给予奖励,对错误答案高置信度给予惩罚,对不确定问题恰当表达犹豫也予以鼓励74% 相似待验证自我改进最大的风险来自奖励信号本身,若奖励定义不当Agent会优化评估指标而非真实目标(Goodhart's Law的强化学习版本)72% 相似待验证研究显示外在奖励可能挤出内在动机(过度辩护效应),导致用户停止获得外在奖励后放弃行为71% 相似待验证苏黎世大学的实验经济学研究发现,当人们惩罚不公平行为时,大脑的奖赏中枢(纹状体)会被激活,产生类似获得奖励的快感69% 相似待验证元认知反馈通过奖励置信度与准确率的一致性,在奖励信号中引入认知诚实度这一与内容质量正交的新维度69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/937641API
curl https://kongchang.com/api/v1/knowledge/claims/937641MCP
get_claim(id=937641)