[KongchangAI]
Unverified50% confidenceFactExact time

Anthropic等公司在对齐研究中依赖对思维链的监控来检测模型的'不忠实推理',即模型输出推理过程与其内部实际决策依据不一致的情况

1
Sources
50%
Confidence
Long-term
Relevance
9/4/2026
First Seen

Sources

Related Entities

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/852182
API
curl https://kongchang.com/api/v1/knowledge/claims/852182
MCP
get_claim(id=852182)