Unverified50% confidenceFactExact time
Claude 是闭源模型,外部研究者只能通过行为观察来逆向推断其内部机制
1
Sources
50%
Confidence
Long-term
Relevance
9/12/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedAnthropic研究人员通过机制可解释性方法在Claude大模型内部发现了类似人脑的全局工作空间结构68% similarUnverifiedAnthropic的Claude选择保留并回传思维链,认为思维链对后续推理更有帮助,但也因此增加了被攻击面63% similarUnverifiedPhysDreamer等研究尝试在扩散模型的采样过程中引入物理约束,确保生成运动符合基本力学规律,仍处于早期研究阶段63% similarUnverified消融实验借鉴自神经科学中通过移除脑区研究功能定位的方法,通过系统性移除或替换模型单个组件来量化每个组件的边际贡献62% similarUnverifiedAnthropic在Claude模型中发现了一个高度类似神经科学'全局工作空间理论'的结构,且该结构并非人为设计而是训练中自行涌现61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/916263API
curl https://kongchang.com/api/v1/knowledge/claims/916263MCP
get_claim(id=916263)