Unverified60% confidenceFactExact time
GLM-5.2的模型权重下载超过1.5TB,即便是1-bit量化的压缩版本也需要大约200GB显存才能运行
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
7/9/2026
First Seen
Valid until: 10/7/2026
Sources
GLM-5.2完全使用指南:开源长上下文模型实测评测
bilibili英文白斑马7/4/2026
Related Claims
UnverifiedGLM-5.2拥有7530亿参数,以BF16精度存储时完整权重文件超过1.5TB77% similarUnverifiedGGUF量化版本可将Flux的显存需求压缩至8-12GB区间73% similarVerifiedGGUF格式的4-bit量化可将模型权重从32位浮点压缩到4位整数,模型体积缩小约8倍72% similarUnverifiedGGUF格式支持4-bit、8-bit等多种精度级别,可将70亿参数模型的内存占用从约14GB(FP16)压缩至约4GB(Q4_K_M量化),推理精度损失通常在1-3%以内70% similarUnverifiedAWQ和GGUF均能将700亿参数模型存储体积从FP16的约140GB压缩至INT4的约35-40GB,可在单张RTX 4090上运行,精度损失通常控制在1-3%以内70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/331732API
curl https://kongchang.com/api/v1/knowledge/claims/331732MCP
get_claim(id=331732)