待验证50% 置信事实精确时间
When scaling to tens of thousands of GPUs, overall compute efficiency can plummet below 40%, with more than half of compute power consumed by data transfer and waiting — a phenomenon known as the 'communication wall.'
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
相关事实
待验证当AI集群规模扩展到数万张GPU时,整体效率可能暴跌到40%以下,超过一半的算力被消耗在数据传输和等待过程中80% 相似待验证对于MuJoCo、Atari等环境,单个环境的采样速度往往跟不上GPU计算能力,导致GPU利用率长期停留在20%–40%甚至更低68% 相似待验证自回归解码阶段GPU算力利用率往往不足10%,属于内存密集型操作65% 相似待验证GPU利用率可从低流量时的20%~30%提升至高流量时的70%~80%,因请求量越大越容易聚合为更大计算批次64% 相似待验证流量规模化后GPU批处理利用率可从低流量时的20%~30%提升至高流量时的70%~80%,形成规模经济和规模壁垒62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/49977API
curl https://kongchang.com/api/v1/knowledge/claims/49977MCP
get_claim(id=49977)