[KongchangAI]
Unverified50% confidenceFactExact time

当对齐训练的惩罚信号过强,模型会趋向于宁可少说绝不出错的保守策略,导致回答冗长、前置免责、绕圈子,这种现象被称为过度对齐或对齐税

1
Sources
50%
Confidence
Long-term
Relevance
9/28/2026
First Seen

Sources

Related Entities

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/957710
API
curl https://kongchang.com/api/v1/knowledge/claims/957710
MCP
get_claim(id=957710)