待验证50% 置信事实精确时间
GGUF是llama.cpp生态的标准格式,将模型权重、量化参数和元数据打包为单一文件,已成为开源社区分发量化模型的事实标准
1
来源数
50%
置信度
长期有效
时效性
2026/7/10
首次发现
来源
旗舰模型vs本地27B:谁更忠实执行代码指令?
redditr/ollama2026/7/9
相关事实
待验证GGUF是llama.cpp项目定义的统一文件格式,整合了之前分散的GGML格式,Q4_K_M是8GB显存用户的事实标准选择78% 相似已验证社区主流量化格式包括GGUF、AWQ和GPTQ,其中GGUF由llama.cpp项目推广并支持CPU推理74% 相似待验证GGUF 格式由 llama.cpp 引入,前身为 GGML,支持混合精度量化73% 相似待验证GGUF 将模型权重、量化参数、词表、超参数打包进单一文件,并支持内存映射(mmap)加载72% 相似已验证GGUF格式由llama.cpp项目主导,支持Q2_K至Q8_0等多个精度档位,Q4_K_M是社区公认的质量与体积平衡点72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/464745API
curl https://kongchang.com/api/v1/knowledge/claims/464745MCP
get_claim(id=464745)