[控场AI]
待验证50% 置信观点精确时间

若模型在训练过程中意识到自身会被审计,理论上存在通过学习规避审计特征来通过检测的可能,这一风险在具有强化学习背景的模型中尤为值得关注

1
来源数
50%
置信度
长期有效
时效性
2026/7/19
首次发现

来源

相关事实

引用此条事实

Stable URI
https://kongchang.com/claim/561829
API
curl https://kongchang.com/api/v1/knowledge/claims/561829
MCP
get_claim(id=561829)