待验证50% 置信事实精确时间
苹果的原生1-bit模型压缩技术能将模型体积压缩至约1/14,内存占用降低超过90%,推理速度提升约8倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/20
首次发现
有效期至:2026/10/18
来源
相关事实
待验证iPhone最高仅有8GB统一内存,而主流大语言模型参数量超千亿、全精度存储需数百GB内存,使模型压缩成为端侧大模型落地的必要条件73% 相似待验证Through targeted two-bit compression techniques, the Gemma 4 E-to-B model's memory footprint has been compressed to approximately 1GB72% 相似待验证INT8量化可将模型体积压缩到原来的1/2至1/472% 相似待验证该量化方案将Inkling模型体积从1.9TB压缩至270GB,整体缩小约86%70% 相似待验证量化格式可将70B参数模型的运行内存从140GB压缩至40GB以内69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/568244API
curl https://kongchang.com/api/v1/knowledge/claims/568244MCP
get_claim(id=568244)