Unverified50% confidenceFactExact time
Self-Attention机制计算复杂度与序列长度平方成正比(O(n²)),一个128K token请求的原生注意力计算量约为4K token请求的1024倍
1
Sources
50%
Confidence
Long-term
Relevance
7/16/2026
First Seen
Sources
Related Claims
Verified标准自注意力机制(Self-Attention)的计算复杂度与序列长度呈平方关系(O(n²))81% similarUnverified注意力机制的计算复杂度为O(n²),其中n为上下文长度,Claude具有200K token上下文窗口80% similarVerified自注意力机制允许模型在处理每个Token时同时看到输入序列中所有其他Token的信息,注意力矩阵计算复杂度为O(n²)79% similarUnverified标准自注意力的计算复杂度为序列长度的平方,实现百万Token上下文需引入稀疏注意力、滑动窗口注意力及KV Cache压缩等技术79% similarUnverified自注意力机制的计算复杂度随序列长度呈近似二次方增长,序列长度为n时注意力矩阵计算量正比于n²79% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/526417API
curl https://kongchang.com/api/v1/knowledge/claims/526417MCP
get_claim(id=526417)