Unverified50% confidenceFactExact time
机制可解释性作为独立研究方向的兴起很大程度上源于Anthropic研究团队,2021年的《A Mathematical Framework for Transformer Circuits》奠定了理论基础
1
Sources
50%
Confidence
Long-term
Relevance
7/19/2026
First Seen
Sources
Related Claims
UnverifiedElhage 等人在2021年的论文《A Mathematical Framework for Transformer Circuits》中系统化了残差流视角76% similarUnverified有限状态机的理论基础由沃伦·麦卡洛克和沃尔特·皮茨在1943年的神经网络研究中奠定,后经摩尔和米利在20世纪50年代形式化为完整的自动机理论64% similarUnverified2024年安全研究人员展示了通过对抗性后缀(Adversarial Suffix)——一串看似无意义的字符序列——来操纵模型输出的技术63% similarUnverified神经形态计算概念最早可追溯到1980年代加州理工学院Carver Mead教授提出用模拟电路直接模拟生物神经系统的工作62% similarUnverified元胞自动机概念最早由数学家约翰·冯·诺依曼和斯坦尼斯拉夫·乌拉姆在20世纪40年代末提出,最初用于研究自我复制的生物系统60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/561819API
curl https://kongchang.com/api/v1/knowledge/claims/561819MCP
get_claim(id=561819)