[KongchangAI]
Unverified50% confidenceFactExact time

2023年Anthropic发表《Towards Monosemanticity》,2024年发表《Scaling and evaluating sparse autoencoders》,研究者借助SAE在Claude等模型中识别出数百万个可解读的特征

1
Sources
50%
Confidence
Long-term
Relevance
7/19/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/561825
API
curl https://kongchang.com/api/v1/knowledge/claims/561825
MCP
get_claim(id=561825)