待验证50% 置信事实精确时间
GLM-5.2拥有7530亿参数,以BF16精度存储时完整权重文件超过1.5TB
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/11
首次发现
有效期至:2026/10/9
来源
GLM-5.2实测:7530亿参数开源模型,性价比完胜GPT与Claude
bilibili黑纹白斑马2026/7/4
相关事实
待验证GGUF格式支持4-bit、8-bit等多种精度级别,可将70亿参数模型的内存占用从约14GB(FP16)压缩至约4GB(Q4_K_M量化),推理精度损失通常在1-3%以内78% 相似待验证GLM-5.2的模型权重下载超过1.5TB,即便是1-bit量化的压缩版本也需要大约200GB显存才能运行77% 相似待验证AWQ和GGUF均能将700亿参数模型存储体积从FP16的约140GB压缩至INT4的约35-40GB,可在单张RTX 4090上运行,精度损失通常控制在1-3%以内71% 相似已验证FP16精度下,大模型每10亿参数约需2GB显存71% 相似已验证Q4_K_M 采用混合精度,部分关键权重以 6bit 存储,其余以 4bit 存储,整体平均约 4.5bit67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/488460API
curl https://kongchang.com/api/v1/knowledge/claims/488460MCP
get_claim(id=488460)