Unverified50% confidenceBenchmarkExact time
27B稠密模型在24GB M4 Pro Mac mini上使用4-bit量化可以运行,速度约为11 tok/s
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/20/2026
First Seen
Valid until: 11/18/2026
Sources
Related Claims
Unverified在128GB的MacBook Pro M3 Max上,独立评测显示DS4生成速度达每秒26.68个Token79% similarUnverified在16GB M4 Mac Mini上,Ornith 9B GGUF版本加载后6.2GB用于模型权重,最大上下文长度可达26万tokens78% similarUnverified测试在一台36GB内存的MacBook上进行,模型以128K上下文大小和Q8 KV缓存加载78% similarUnverifiedLlama 3.3 70B经过4-bit量化后模型大小约为40GB,可在配备64GB内存的Mac Studio或单张48GB显存的专业GPU上运行78% similarUnverified30B级别的Dense模型被视为本地部署的甜蜜区间,可在M2 Ultra(192GB)、M4 Pro(48GB)等Apple Silicon设备或配合量化技术的RTX 4090(24GB VRAM)上运行76% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/779028API
curl https://kongchang.com/api/v1/knowledge/claims/779028MCP
get_claim(id=779028)