Unverified50% confidenceBenchmarkExact time
FlashAttention通过分块Tiling和重计算策略,将HBM访问次数从O(N²)降至O(N²/M),长序列场景下速度提升达2-4倍
1
Sources
50%
Confidence
Long-term
Relevance
7/15/2026
First Seen
Sources
Related Claims
Unverified快速傅里叶变换将DFT的计算复杂度从朴素的O(N²)降低到O(N log N)66% similarUnverified分解子域策略可将步数复杂度从O((L/w)²)降低到O(L²/(N·w²)),其中N为子域数目62% similarUnverified多头自注意力机制突破了RNN/LSTM在长序列处理中因梯度消失导致的遗忘瓶颈,并支持GPU/TPU大规模并行计算61% similarUnverified自注意力机制解决了RNN架构在处理长序列时的梯度消失问题,并天然支持大规模并行计算61% similarVerifiedHNSW通过构建多层图索引将搜索复杂度降至近似O(log n),IVF通过K-means聚类分割向量空间以牺牲约5-10%召回率换取数量级速度提升61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/512121API
curl https://kongchang.com/api/v1/knowledge/claims/512121MCP
get_claim(id=512121)