Unverified50% confidenceFactExact time
GLM 5.2常规版本约400GB,全精度BF16版本高达1.5TB,量化剪枝后仍在约200GB
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/10/2026
First Seen
Valid until: 10/8/2026
Sources
本地跑大模型是幻觉?开放权重的真实价值与硬件门槛
youtubeTheo - t3․gg7/7/2026
Related Claims
Unverified以 GGUF Q4 量化为基准,7B 模型约需 4-6GB 显存,13B 约需 8-10GB,70B 需 40GB 以上或多 GPU 并行76% similarUnverifiedUnsloth为Granite 4.1 3B模型发布了21种GGUF格式量化版本,文件大小从1.2GB到6.34GB不等,总计约51.3GB74% similarVerifiedDeepSeek R1 7B版本原始FP16精度约需14GB存储,量化后仅需4.7GB71% similarUnverifiedLLaMA-2-7B使用FP16精度时每个token的KV Cache约占0.5MB71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/410823API
curl https://kongchang.com/api/v1/knowledge/claims/410823MCP
get_claim(id=410823)