待验证50% 置信事实精确时间
128GB DDR5内存能完整加载70B级别模型的所有权重,但速度约为2-5 tokens/s
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/7
首次发现
有效期至:2026/11/5
来源
相关事实
待验证DDR5四根内存插满时频率会大幅下降(单Rank双条能跑6000,四条可能只能跑5200-5600),追求容量又要高频应选2×32GB而非4×16GB78% 相似待验证MiMo-V2.5主模型在双24GB显卡配合96/128GB DDR5内存的VRAM offload配置下,运行速度约为8-10 tokens/s78% 相似待验证分辨率越高单位时间存储占用越大,4K约需1GB/2分钟,若只配32GB存储循环覆盖过快取证价值低;建议4K机型至少搭配128GB高速卡(U3/V30)75% 相似待验证容量选择上,同系列产品1TB和2TB的每GB成本明显低于512GB,且大容量盘的SLC缓存区更大、TBW更高、持续写入速度更稳定,512GB性价比和性能均不占优74% 相似待验证llama.cpp的GGUF格式4-bit量化版本使Llama 3.1 70B模型可在配备64GB统一内存的Apple M2 Ultra上运行,推理速度约20-30 tokens/秒74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/704254API
curl https://kongchang.com/api/v1/knowledge/claims/704254MCP
get_claim(id=704254)