待验证50% 置信事实精确时间
以3×3卷积核、输入输出均为256通道的层为例,标准卷积需约59万参数,深度可分离卷积仅需约6.7万参数,参数量降低约8-9倍
1
来源数
50%
置信度
长期有效
时效性
2026/9/1
首次发现
来源
涉及实体
相关事实
待验证三元表示理论上每个参数只需约1.58比特,相比FP16可以带来近10倍的存储压缩73% 相似待验证一个原始需要80GB显存的700亿参数模型经4-bit量化(Q4_K_M档)后仅需约40GB内存,推理质量在多数基准测试中损失通常在3%-8%以内70% 相似待验证采用INT4量化可将700亿参数模型显存需求压缩至约40GB(2张A100),但会带来约3-5%的性能损耗70% 相似部分验证标准的FP32模型每个参数占用4字节,而INT4量化将其压缩至0.5字节,理论上可实现8倍的内存节省68% 相似待验证1750亿参数模型仅模型权重(BF16精度)就需350GB存储,Adam优化器需维护一阶矩和二阶矩两份状态,合计超过1TB68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/837584API
curl https://kongchang.com/api/v1/knowledge/claims/837584MCP
get_claim(id=837584)