待验证60% 置信事实精确时间
GLM-5.2的模型权重下载超过1.5TB,即便是1-bit量化的压缩版本也需要大约200GB显存才能运行
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/7/9
首次发现
有效期至:2026/10/7
来源
GLM-5.2完全使用指南:开源长上下文模型实测评测
bilibili英文白斑马2026/7/4
相关事实
待验证GLM-5.2拥有7530亿参数,以BF16精度存储时完整权重文件超过1.5TB77% 相似待验证GGUF量化版本可将Flux的显存需求压缩至8-12GB区间73% 相似已验证GGUF格式的4-bit量化可将模型权重从32位浮点压缩到4位整数,模型体积缩小约8倍72% 相似待验证GGUF格式支持4-bit、8-bit等多种精度级别,可将70亿参数模型的内存占用从约14GB(FP16)压缩至约4GB(Q4_K_M量化),推理精度损失通常在1-3%以内70% 相似待验证AWQ和GGUF均能将700亿参数模型存储体积从FP16的约140GB压缩至INT4的约35-40GB,可在单张RTX 4090上运行,精度损失通常控制在1-3%以内70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/331732API
curl https://kongchang.com/api/v1/knowledge/claims/331732MCP
get_claim(id=331732)