待验证70% 置信事实精确时间
llama-server 是 llama.cpp 提供的本地 HTTP 推理服务,实现了与 OpenAI Chat Completions API 高度兼容的接口规范
2
来源数
70%
置信度
长期有效
时效性
2026/7/8
首次发现
来源
Unsloth v0.1.461-beta:修复本地GGUF视觉模型加载问题
rss2026/6/12
相关事实
待验证Ollama 的底层推理引擎基于 llama.cpp 构建,默认监听 localhost:11434 端口提供 API 服务72% 相似待验证OpenAI兼容协议定义了标准化HTTP REST接口,包括/v1/chat/completions、/v1/completions等端点,切换模型提供商只需更换Base URL和API Key60% 相似待验证WASI(WebAssembly System Interface)规范标准化了WASM访问文件、网络等系统资源的接口59% 相似待验证OpenAI的/v1/chat/completions端点采用messages数组和SSE(服务器发送事件)作为流式输出的传输协议59% 相似待验证Unsloth Desktop提供与OpenAI兼容的API,并支持通过Cloudflare HTTPS将本地部署的LLM远程发布58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/219256API
curl https://kongchang.com/api/v1/knowledge/claims/219256MCP
get_claim(id=219256)