待验证50% 置信基准精确时间
27B稠密模型在24GB M4 Pro Mac mini上使用4-bit量化可以运行,速度约为11 tok/s
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/20
首次发现
有效期至:2026/11/18
来源
相关事实
待验证在128GB的MacBook Pro M3 Max上,独立评测显示DS4生成速度达每秒26.68个Token79% 相似待验证在16GB M4 Mac Mini上,Ornith 9B GGUF版本加载后6.2GB用于模型权重,最大上下文长度可达26万tokens78% 相似待验证测试在一台36GB内存的MacBook上进行,模型以128K上下文大小和Q8 KV缓存加载78% 相似待验证Llama 3.3 70B经过4-bit量化后模型大小约为40GB,可在配备64GB内存的Mac Studio或单张48GB显存的专业GPU上运行78% 相似待验证30B级别的Dense模型被视为本地部署的甜蜜区间,可在M2 Ultra(192GB)、M4 Pro(48GB)等Apple Silicon设备或配合量化技术的RTX 4090(24GB VRAM)上运行76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/779028API
curl https://kongchang.com/api/v1/knowledge/claims/779028MCP
get_claim(id=779028)