Unverified60% confidenceFactExact time
当前主流大语言模型普遍采用Transformer架构,其自注意力机制在处理长上下文时计算复杂度与序列长度呈二次方增长(O(n²))
2
Sources
60%
Confidence
Long-term
Relevance
7/17/2026
First Seen
Sources
Related Claims
Verified大语言模型的记忆本质上依赖于Transformer架构的注意力机制,其有效信息容量受限于上下文窗口的token数量78% similarVerified基于Transformer的大语言模型使用注意力机制将系统提示、用户输入和外部检索内容统一编码为同质化的token序列,模型无法在语义层面区分可信指令与不可信数据77% similarUnverifiedTransformer通过自注意力机制实现了对长文本的高效建模76% similarVerified注意力机制(Attention Mechanism)是Transformer架构的核心组件,也是当前所有主流大语言模型的基础76% similarVerified大语言模型基于Transformer架构,通过海量文本数据训练而成76% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/547349API
curl https://kongchang.com/api/v1/knowledge/claims/547349MCP
get_claim(id=547349)