待验证50% 置信事实精确时间
液态卷积的计算复杂度与序列长度呈线性关系O(n),而非自注意力的平方关系O(n²),处理128K Tokens时计算量仅为注意力层的约1/1000
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
LFM2.5本地部署实测:8B参数碾压GPT-o3s的工具调用能力
bilibiliAGI_Ananas2026/6/1
相关事实
待验证传统NMS的时间复杂度为O(N²),YOLOv11对于640×640输入会产生8400个候选框,密集场景下NMS计算量增加64% 相似待验证以7B参数模型为例,每增加1K Token 的上下文约消耗 0.5~1 GB 显存62% 相似待验证对于拥有32层、32头注意力的典型7B模型,每个token需约0.5MB显存存储KV Cache,生成1000个token则需额外约500MB显存61% 相似待验证以 float16 精度为基准每个参数约占 2 字节,7B 模型约需 14GB 显存/内存,70B 模型约需 140GB61% 相似待验证128GB的统一内存池意味着可以在本地运行700亿参数量级甚至更大的量化模型61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/49059API
curl https://kongchang.com/api/v1/knowledge/claims/49059MCP
get_claim(id=49059)