Unverified50% confidenceFactExact time
GGUF专门为CPU和混合CPU/GPU推理场景优化,支持内存映射(mmap)加载,可通过部分offload到系统内存运行超出显存容量的模型
1
Sources
50%
Confidence
Long-term
Relevance
8/25/2026
First Seen
Sources
Related Entities
Related Claims
VerifiedGGUF是llama.cpp生态广泛使用的格式,支持2bit至8bit灵活量化粒度,对CPU推理友好79% similarVerified模型权重通常以GGUF格式分发,这是由llama.cpp项目定义的一种专为CPU/GPU混合推理优化的模型文件格式78% similarVerifiedGGUF 格式由 llama.cpp 项目引入,专为 CPU 推理场景优化78% similarUnverifiedGGML是Gerganov自研的张量运算库,专为CPU推理优化,采用纯C实现,可在ARM、x86等架构上运行78% similarUnverifiedggml用纯C/C++实现、无需重型依赖、支持量化、能在CPU上高效运行,同时也可利用GPU加速77% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/798074API
curl https://kongchang.com/api/v1/knowledge/claims/798074MCP
get_claim(id=798074)