待验证50% 置信事实精确时间
30B级别的Dense模型被视为本地部署的甜蜜区间,可在M2 Ultra(192GB)、M4 Pro(48GB)等Apple Silicon设备或配合量化技术的RTX 4090(24GB VRAM)上运行
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/16
首次发现
有效期至:2026/11/14
来源
相关事实
待验证RTX 4090拥有24GB VRAM,可流畅运行大多数13B-34B量化模型76% 相似待验证27B稠密模型在24GB M4 Pro Mac mini上使用4-bit量化可以运行,速度约为11 tok/s76% 相似待验证RTX 4090拥有24GB显存,在加载27B Q4模型后通常还有足够空间支持3-4万Token的上下文73% 相似已验证8GB显存建议运行7B模型(Q4量化),16GB显存建议运行7B到14B模型,24GB显存建议运行14B到32B模型,32GB显存建议运行32B到70B模型(Q4量化)73% 相似待验证一块24GB显存的RTX 4090可流畅运行Qwen3-32B的4-bit量化版本73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/757574API
curl https://kongchang.com/api/v1/knowledge/claims/757574MCP
get_claim(id=757574)