已验证65% 置信概念精确时间
基准过拟合是Goodhart定律在AI评估领域的体现,即衡量指标成为优化目标时便失去衡量有效性
3
来源数
65%
置信度
长期有效
时效性
2026/7/19
首次发现
来源
相关事实
待验证Goodhart定律指出当一个度量成为目标时,它就不再是好的度量,该定律适用于AI评测军备竞赛问题84% 相似待验证古德哈特定律指出当某个质量指标成为优化目标,它就不再是好的质量度量,模型可能学会刷分而非真正改善78% 相似待验证当一个衡量指标变成目标,它就不再是一个好的衡量指标(Goodhart定律),当行业围绕MMLU、HumanEval、MATH等基准竞赛时这些测试被过度优化77% 相似待验证智能体的目标对齐(goal alignment)问题至今未被根本解决,系统只能优化可量化的代理指标,容易陷入Goodhart定律陷阱75% 相似已验证古德哈特定律描述:当一个度量指标变成目标时,它就不再是好的度量指标了72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/556862API
curl https://kongchang.com/api/v1/knowledge/claims/556862MCP
get_claim(id=556862)