[KongchangAI]
Unverified50% confidenceFactExact time

RLHF中人类评估者在主观创作判断时倾向给予结构完整、措辞礼貌的答案更高分,这种偏差被称为奖励黑客的一种变体

1
Sources
50%
Confidence
Long-term
Relevance
7/6/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/114664
API
curl https://kongchang.com/api/v1/knowledge/claims/114664
MCP
get_claim(id=114664)