待验证60% 置信事实精确时间
4B参数模型(如Phi-3-mini或Llama 3.2 3B)仅需约8GB显存,可以在消费级GPU上运行
2
来源数
60%
置信度
长期有效
时效性
2026/9/3
首次发现
来源
涉及实体
相关事实
待验证运行具备实用能力的开源模型(如Llama 3或Qwen2.5)通常需要至少16GB显存的GPU77% 相似已验证以 GGUF Q4 量化为基准,7B 模型约需 4-6GB 显存,13B 约需 8-10GB,70B 需 40GB 以上或多 GPU 并行75% 相似待验证3B~4B级别模型如Qwen2.5 3B或Llama 3.2 3B在Q4量化下仅需2~2.5GB显存74% 相似待验证Llama 3.1 7B量化后仅需约4-5GB显存即可运行73% 相似待验证在16GB内存硬件条件下只能容纳5GB以内的模型,因此该开发者使用了体积约4.8GB的Qwen 2.5 7B 4bit量化模型,配8K上下文窗口71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/851372API
curl https://kongchang.com/api/v1/knowledge/claims/851372MCP
get_claim(id=851372)