待验证50% 置信事实精确时间
Muse Glimmer全精度运行需要55GB显存,通过4-bit量化后压缩到20GB以内,可在24GB显存的消费级显卡上运行
1
来源数
50%
置信度
长期有效
时效性
2026/8/15
首次发现
来源
相关事实
待验证Llama 3 70B量化版(Q4精度)仍需约35GB内存72% 相似待验证以 GGUF Q4 量化为基准,7B 模型约需 4-6GB 显存,13B 约需 8-10GB,70B 需 40GB 以上或多 GPU 并行72% 相似待验证Muse-Glimmer-30B参数规模为30B级别(实测架构约28B),支持128K上下文,并在发布时提供本地量化版本71% 相似待验证GLM 5.2常规版本约400GB,全精度BF16版本高达1.5TB,量化剪枝后仍在约200GB71% 相似待验证Llama 3.3 70B经过4-bit量化后模型大小约为40GB,可在配备64GB内存的Mac Studio或单张48GB显存的专业GPU上运行70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/754277API
curl https://kongchang.com/api/v1/knowledge/claims/754277MCP
get_claim(id=754277)