已验证65% 置信事实精确时间
Apple M3 Max(128GB统一内存)可流畅运行未量化的70B模型
3
来源数
65%
置信度
中期 (~90 天)
时效性
2026/7/17
首次发现
有效期至:2026/10/15
来源
相关事实
待验证苹果A18 Pro统一内存架构最高支持16GB,内存带宽达68GB/s,Neural Engine算力达35 TOPS79% 相似待验证M3 Max 配备最高 128GB 统一内存,可运行未量化的 70B 甚至更大规模模型,远超消费级 NVIDIA 显卡最高 24GB 的上限78% 相似待验证本地推理受限于用户硬件,一个7B参数量化模型(如Llama 3 8B的Q4版本)文件约4-5GB,在Apple M系列芯片Mac上可达每秒20-40个token,在仅有集成显卡和8GB内存的笔记本上可能降至每秒3-5个token77% 相似已验证Apple M系列芯片的内存带宽可达200-800GB/s(取决于具体型号)74% 相似待验证27B稠密模型在24GB M4 Pro Mac mini上使用4-bit量化可以运行,速度约为11 tok/s74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/544246API
curl https://kongchang.com/api/v1/knowledge/claims/544246MCP
get_claim(id=544246)