Unverified50% confidenceFactExact time
可解释性研究试图通过机械可解释性、注意力可视化、特征归因等方法理解模型内部工作机制
1
Sources
50%
Confidence
Long-term
Relevance
9/6/2026
First Seen
Sources
Related Entities
Related Claims
Unverified雅可比透镜方法由Anthropic在其"全局工作空间"研究中提出,用于观察和引导模型内部表征76% similarUnverifiedAnthropic、DeepMind 等机构的可解释性研究显示,目前只能通过激活分析、注意力可视化等有限手段部分理解模型内部状态73% similarUnverifiedAnthropic等公司正在深入研究机制性可解释性(Mechanistic Interpretability),试图直接在激活空间中寻找可读的特征与回路69% similarUnverified雅可比透镜(Jacobian Lens)方法源自Anthropic的可解释性研究,用于观察和引导模型内部表征69% similarUnverified神经元激活可视化是AI可解释性研究的核心议题之一68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/863315API
curl https://kongchang.com/api/v1/knowledge/claims/863315MCP
get_claim(id=863315)