待验证50% 置信事实精确时间
Nanosaur 2 模型本体约 1.3GB,加载文本编码器和 VAE 后总体积约 2GB
1
来源数
50%
置信度
长期有效
时效性
2026/9/26
首次发现
来源
涉及实体
相关事实
已验证即便用 4-bit 量化把权重压缩到 214GB,仍远超单张 48GB 显卡的容量66% 相似待验证M3原始权重存储下限:BF16约854GB,8-bit约428GB,4-bit约214GB64% 相似待验证IQ2_XS可以将模型压缩到接近2 bit/权重,使原本需要48GB显存的70B模型能塞入24GB消费级显卡64% 相似待验证内存需求为Q2_0至少37.6GB、IQ2_XS至少39.2GB、IQ3_XXS至少47GB,视觉编码器额外占用0.91GB64% 相似待验证在16GB M4 Mac Mini上,Ornith 9B GGUF版本加载后6.2GB用于模型权重,最大上下文长度可达26万tokens63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/951743API
curl https://kongchang.com/api/v1/knowledge/claims/951743MCP
get_claim(id=951743)