待验证50% 置信事实精确时间
截至2025年llama.cpp已支持LLaMA、Qwen、Mistral、Gemma、Phi等数十种模型架构,并支持CPU、NVIDIA CUDA、Apple Metal及AMD ROCm/HIP后端
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/6
首次发现
有效期至:2026/12/5
来源
涉及实体
相关事实
待验证llama.cpp 于 2023 年初以仅用 CPU 运行 LLaMA 模型,随后支持 Metal、CUDA、ROCm 等硬件加速后端75% 相似已验证llama.cpp支持NVIDIA GPU通过CUDA、AMD GPU通过ROCm、Apple Silicon通过Metal GPU加速,也支持纯CPU推理74% 相似待验证Ollama底层通过llama.cpp实现跨平台推理,支持NVIDIA CUDA、Apple Metal(M系列芯片)和纯CPU三种计算后端71% 相似待验证Ollama在llama.cpp基础上封装了REST API和模型管理功能,llama.cpp支持CUDA、Metal、Vulkan、ROCm多种硬件后端70% 相似已验证Ollama支持CPU的AVX2/AVX512指令集加速,以及NVIDIA CUDA、Apple Metal、AMD ROCm等多种GPU后端69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/866085API
curl https://kongchang.com/api/v1/knowledge/claims/866085MCP
get_claim(id=866085)