待验证50% 置信事实精确时间
Claude 是闭源模型,外部研究者只能通过行为观察来逆向推断其内部机制
1
来源数
50%
置信度
长期有效
时效性
2026/9/12
首次发现
来源
涉及实体
相关事实
待验证Anthropic研究人员通过机制可解释性方法在Claude大模型内部发现了类似人脑的全局工作空间结构68% 相似待验证Anthropic的Claude选择保留并回传思维链,认为思维链对后续推理更有帮助,但也因此增加了被攻击面63% 相似待验证PhysDreamer等研究尝试在扩散模型的采样过程中引入物理约束,确保生成运动符合基本力学规律,仍处于早期研究阶段63% 相似待验证消融实验借鉴自神经科学中通过移除脑区研究功能定位的方法,通过系统性移除或替换模型单个组件来量化每个组件的边际贡献62% 相似待验证Anthropic在Claude模型中发现了一个高度类似神经科学'全局工作空间理论'的结构,且该结构并非人为设计而是训练中自行涌现61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/916263API
curl https://kongchang.com/api/v1/knowledge/claims/916263MCP
get_claim(id=916263)