Unverified50% confidenceFactExact time
Muse Glimmer全精度运行需要55GB显存,通过4-bit量化后压缩到20GB以内,可在24GB显存的消费级显卡上运行
1
Sources
50%
Confidence
Long-term
Relevance
8/15/2026
First Seen
Sources
Related Claims
UnverifiedLlama 3 70B量化版(Q4精度)仍需约35GB内存72% similarUnverified以 GGUF Q4 量化为基准,7B 模型约需 4-6GB 显存,13B 约需 8-10GB,70B 需 40GB 以上或多 GPU 并行72% similarUnverifiedMuse-Glimmer-30B参数规模为30B级别(实测架构约28B),支持128K上下文,并在发布时提供本地量化版本71% similarUnverifiedGLM 5.2常规版本约400GB,全精度BF16版本高达1.5TB,量化剪枝后仍在约200GB71% similarUnverifiedLlama 3.3 70B经过4-bit量化后模型大小约为40GB,可在配备64GB内存的Mac Studio或单张48GB显存的专业GPU上运行70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/754277API
curl https://kongchang.com/api/v1/knowledge/claims/754277MCP
get_claim(id=754277)