Unverified50% confidenceFactExact time
GPU的SM能同时驻留的Warp数量决定了GPU隐藏内存访问延迟的能力,制约Occupancy的核心资源是寄存器文件与共享内存
1
Sources
50%
Confidence
Long-term
Relevance
7/7/2026
First Seen
Sources
Vulkan描述符堆端到端支持:简化GPU资源绑定与Bindless渲染
rss6/25/2026
Related Claims
UnverifiedGPU存储层次从快到慢为:寄存器、L1缓存/共享内存、L2缓存、全局显存79% similarUnverifiedGPU上下文切换需保存完整GPU状态(包括寄存器文件、共享内存和L1缓存),数据量可达数百MB,而CPU上下文切换仅需保存几KB77% similarUnverified缓存过期本质上是服务商在GPU显存压力与用户体验之间的权衡,长期维持大量KV Cache会占用推理容量74% similarUnverified当专用GPU显存不够用时,Windows系统会自动将部分数据转移到从系统RAM划拨的共享GPU内存中73% similarVerified统一内存架构使CPU、GPU与NPU共享同一块内存池,避免数据在处理单元间反复搬运的开销73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/187942API
curl https://kongchang.com/api/v1/knowledge/claims/187942MCP
get_claim(id=187942)