待验证50% 置信发布精确时间
开发者提供五种量化格式:INT8 ConvRot(4.5GB)、FP8 E4M3(4.2GB)、bf16(8.3GB)、NVFP4(2.9GB)、MXFP8(4.7GB)
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/20
首次发现
有效期至:2026/10/18
来源
相关事实
待验证从存储角度推算:27B参数×2字节(FP16)约54GB,INT8约27GB,INT4约13.5GB,2-bit约6.75GB,1.5-bit逼近5GB;4GB以内意味着平均比特宽度需低于1.5-bit80% 相似待验证在16GB内存硬件条件下只能容纳5GB以内的模型,因此该开发者使用了体积约4.8GB的Qwen 2.5 7B 4bit量化模型,配8K上下文窗口78% 相似已验证8GB显存建议运行7B模型(Q4量化),16GB显存建议运行7B到14B模型,24GB显存建议运行14B到32B模型,32GB显存建议运行32B到70B模型(Q4量化)77% 相似待验证千问3.5 9B模型约6.6GB,适合8GB显存的显卡75% 相似待验证M3原始权重存储下限:BF16约854GB,8-bit约428GB,4-bit约214GB74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/568120API
curl https://kongchang.com/api/v1/knowledge/claims/568120MCP
get_claim(id=568120)