待验证50% 置信事实精确时间
M3的GPU引入了动态缓存(Dynamic Caching),实现硬件级别的按需资源分配
1
来源数
50%
置信度
长期有效
时效性
2026/9/7
首次发现
来源
涉及实体
相关事实
已验证GPU存储层次从快到慢为:寄存器、L1缓存/共享内存、L2缓存、全局显存74% 相似待验证传统AI芯片(GPU或TPU)将模型权重存储在内存中,计算单元按需读取执行,大量时间和能耗消耗在权重搬运上73% 相似待验证GPU方案通过批处理技术将多个用户请求合并计算,可大幅提升总体吞吐量,是延迟与吞吐量的权衡72% 相似待验证KV缓存(Key-Value Cache)策略将已计算的注意力键值对存储在GPU显存中以供复用,会大量占用GPU内存资源71% 相似待验证GPU上下文切换需保存完整GPU状态(包括寄存器文件、共享内存和L1缓存),数据量可达数百MB,而CPU上下文切换仅需保存几KB71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/874352API
curl https://kongchang.com/api/v1/knowledge/claims/874352MCP
get_claim(id=874352)