待验证50% 置信基准精确时间
FlashAttention通过分块Tiling和重计算策略,将HBM访问次数从O(N²)降至O(N²/M),长序列场景下速度提升达2-4倍
1
来源数
50%
置信度
长期有效
时效性
2026/7/15
首次发现
来源
相关事实
待验证快速傅里叶变换将DFT的计算复杂度从朴素的O(N²)降低到O(N log N)66% 相似待验证分解子域策略可将步数复杂度从O((L/w)²)降低到O(L²/(N·w²)),其中N为子域数目62% 相似待验证多头自注意力机制突破了RNN/LSTM在长序列处理中因梯度消失导致的遗忘瓶颈,并支持GPU/TPU大规模并行计算61% 相似待验证自注意力机制解决了RNN架构在处理长序列时的梯度消失问题,并天然支持大规模并行计算61% 相似已验证HNSW通过构建多层图索引将搜索复杂度降至近似O(log n),IVF通过K-means聚类分割向量空间以牺牲约5-10%召回率换取数量级速度提升61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/512121API
curl https://kongchang.com/api/v1/knowledge/claims/512121MCP
get_claim(id=512121)