Unverified50% confidenceFactExact time
GGUF是llama.cpp生态的标准格式,将模型权重、量化参数和元数据打包为单一文件,已成为开源社区分发量化模型的事实标准
1
Sources
50%
Confidence
Long-term
Relevance
7/10/2026
First Seen
Sources
旗舰模型vs本地27B:谁更忠实执行代码指令?
redditr/ollama7/9/2026
Related Claims
UnverifiedGGUF是llama.cpp项目定义的统一文件格式,整合了之前分散的GGML格式,Q4_K_M是8GB显存用户的事实标准选择78% similarVerified社区主流量化格式包括GGUF、AWQ和GPTQ,其中GGUF由llama.cpp项目推广并支持CPU推理74% similarUnverifiedGGUF 格式由 llama.cpp 引入,前身为 GGML,支持混合精度量化73% similarUnverifiedGGUF 将模型权重、量化参数、词表、超参数打包进单一文件,并支持内存映射(mmap)加载72% similarVerifiedGGUF格式由llama.cpp项目主导,支持Q2_K至Q8_0等多个精度档位,Q4_K_M是社区公认的质量与体积平衡点72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/464745API
curl https://kongchang.com/api/v1/knowledge/claims/464745MCP
get_claim(id=464745)