Unverified50% confidenceFactExact time
Ollama 默认使用 Q4_K_M 等量化方案,将 31B 参数模型的显存需求从约 62GB(FP16)降低到约 20GB
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Gemma 4开源模型本地部署教程:Ollama安装与手机端运行指南
bilibili搞机零距离-6/10/2026
Related Claims
Cite This Claim
Stable URI
https://kongchang.com/claim/47987API
curl https://kongchang.com/api/v1/knowledge/claims/47987MCP
get_claim(id=47987)