Unverified60% confidenceFactExact time
滑动窗口注意力将注意力计算复杂度从O(n²)降至O(n·w),使长文本显存开销线性化
2
Sources
60%
Confidence
Long-term
Relevance
7/21/2026
First Seen
Sources
Related Claims
UnverifiedInformer通过ProbSparse稀疏注意力将自注意力计算复杂度从O(n²)降至O(n log n)84% similarUnverifiedLongformer、BigBird通过局部滑动窗口注意力加少量全局token的混合注意力策略,将计算复杂度从O(n²)降至O(n)84% similarUnverified滑动窗口注意力(如Mistral采用的方案)通过限制每个token只关注固定窗口内的历史,将复杂度从O(n²)降至O(n·w)82% similarUnverified标准自注意力的计算复杂度为序列长度的平方,实现百万Token上下文需引入稀疏注意力、滑动窗口注意力及KV Cache压缩等技术79% similarUnverifiedLongformer由Allen AI提出,采用滑动窗口局部注意力加全局注意力token的组合策略,将复杂度从O(n²)降至O(n)79% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/580785API
curl https://kongchang.com/api/v1/knowledge/claims/580785MCP
get_claim(id=580785)