[KongchangAI]
Unverified60% confidenceBenchmarkExact time

FlashAttention将注意力机制的QKV运算、softmax和输出投影融合为单个kernel,将内存复杂度从O(N²)降至O(N),实现2-4倍端到端加速

2
Sources
60%
Confidence
Long-term
Relevance
9/7/2026
First Seen

Sources

Related Entities

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/870407
API
curl https://kongchang.com/api/v1/knowledge/claims/870407
MCP
get_claim(id=870407)