Unverified50% confidenceFactExact time
标准 Scaled Dot-Product Attention 中 Q 与 K 做矩阵乘法得到 n×n 注意力分数矩阵,计算量为 O(n²·d)
1
Sources
50%
Confidence
Long-term
Relevance
7/12/2026
First Seen
Sources
vLLM推理框架详解:吞吐优化核心原理与面试攻略
bilibiliAI大模型升升6/9/2026
Related Claims
Unverified标准注意力机制中,Query矩阵与Key矩阵做矩阵乘法得到n×n注意力分数矩阵,计算复杂度为O(n²·d)84% similarUnverified标准的Scaled Dot-Product Attention随着序列长度N增加,每个位置能分配到的平均注意力权重以1/N的速率稀释83% similarUnverified自注意力机制的计算复杂度随序列长度呈近似二次方增长,序列长度为n时注意力矩阵计算量正比于n²80% similarUnverified标准注意力机制具有O(n²)的显存开销,行数2000时需计算约2000×2000的注意力矩阵79% similarVerified自注意力机制允许模型在处理每个Token时同时看到输入序列中所有其他Token的信息,注意力矩阵计算复杂度为O(n²)78% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/490176API
curl https://kongchang.com/api/v1/knowledge/claims/490176MCP
get_claim(id=490176)