待验证50% 置信事实精确时间
Ollama 默认使用 GGUF 模型格式,将模型权重、分词器、元数据统一封装在单个文件中,支持多种量化级别(如 Q4_K_M、Q5_K_S、Q8_0)
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/10
首次发现
有效期至:2026/12/9
来源
涉及实体
相关事实
已验证GGUF 将模型权重、量化参数、词表、超参数打包进单一文件,并支持内存映射(mmap)加载76% 相似已验证GGUF格式采用键值元数据头部设计,内置分词器词表等运行所需元信息,使单一文件即可完整描述一个可运行模型74% 相似待验证主流本地LLM运行工具包括Ollama、llama.cpp和LM Studio,均支持GGUF等量化格式71% 相似待验证GGUF是llama.cpp项目定义的统一文件格式,整合了之前分散的GGML格式,Q4_K_M是8GB显存用户的事实标准选择70% 相似已验证GGUF格式由llama.cpp项目主导,支持Q2_K至Q8_0等多个精度档位,Q4_K_M是社区公认的质量与体积平衡点69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/888201API
curl https://kongchang.com/api/v1/knowledge/claims/888201MCP
get_claim(id=888201)