Unverified50% confidenceFactExact time
Anthropic 团队发现了叠加假说,认为模型在有限维度中压缩存储远多于维度数量的特征
1
Sources
50%
Confidence
Long-term
Relevance
7/8/2026
First Seen
Sources
语言模型中的全局工作空间理论:AI可解释性新视角
hackernewshackernews7/6/2026
Related Claims
Unverified一篇由斯坦福、MIT、哈佛及Anthropic研究人员合著的论文提出,由于神经元资源有限,更大的模型总能学习到小模型难以掌握的稀有数据分布65% similarUnverifiedAnthropic的机械可解释性研究成果《Towards Monosemanticity》通过稀疏自编码器在Claude模型中识别出数百万个可解释特征61% similarUnverified经典矩阵补全理论最初依赖不相干性(incoherence)假设,后来研究者逐步放松这一条件产出了大量工作60% similarUnverifiedAnthropic研究人员通过机制可解释性方法在Claude大模型内部发现了类似人脑的全局工作空间结构59% similarUnverified加工深度理论由心理学家Craik和Lockhart在1972年提出,认为信息被加工的深度越深,记忆和认知影响就越持久58% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/222441API
curl https://kongchang.com/api/v1/knowledge/claims/222441MCP
get_claim(id=222441)