Unverified50% confidenceFactExact time
机制可解释性领域奠基人之一是Anthropic研究者Chris Olah,其早期在神经网络特征可视化方面的工作奠定了方法论基础
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
雅可比透镜实战:用J-Space手动改造大语言模型行为
redditr/LocalLLaMA7/11/2026
Related Claims
Unverified机械可解释性方向由Anthropic研究员Chris Olah及其团队系统化推进78% similarUnverified闭环优化这一思路最早应用于脑机接口领域,后逐渐渗透到感知神经科学研究中70% similarUnverifiedAnthropic研究人员通过机制可解释性方法在Claude大模型内部发现了类似人脑的全局工作空间结构69% similarUnverified1960年代Allan Collins和Ross Quillian提出语义网络模型,认为人脑知识以节点和边组成的网络结构组织67% similarUnverifiedTom Brown是GPT-3论文第一作者,Chris Olah是神经网络可解释性先驱,两人均为从OpenAI转投Anthropic的资深科学家67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/501498API
curl https://kongchang.com/api/v1/knowledge/claims/501498MCP
get_claim(id=501498)