Ollama
Ollama 是一款开源的本地大语言模型运行框架,允许用户在个人计算机上部署和运行多种大型语言模型,无需依赖云端服务。它提供命令行界面与 REST API,支持 Llama、Mistral 等主流开源模型,并通过简洁的模型管理机制实现模型的下载、切换与运行,适用于开发者进行本地推理、调试与应用集成。
Core Facts
Timeline (last 90 days)
SoulFlow-Orchestrator 提供 9 个供应商中立(provider-neutral)的后端接入,包括 Claude、Codex、Gemini、OpenAI 以及本地部署的 Ollama
涉及敏感资料时应优先考虑 Ollama 等本地方案,避免文档内容发送到云端模型
Paperless-AI 支持 OpenAI API、Ollama、Deepseek-r1、Azure OpenAI 以及所有兼容 OpenAI API 的第三方服务
使用 Paperless-AI 需准备对应 AI 服务的 API 密钥或本地 Ollama 环境,并配置与 Paperless-ngx 的对接参数
围绕 GitHub Copilot 衍生出 Tabby、Continue 等开源替代品,围绕 OpenAI API 涌现出 LocalAI、Ollama 等本地化部署工具
相比 llama.cpp 或 Ollama,MLX 使用 Python 优先的 API 并针对 Metal 做了底层优化,在 M 系列芯片上通常能取得更高的 tokens/秒吞吐量
locally-uncensored 支持通过 Ollama 运行本地开源模型,包括 Gemma、Llama、Qwen 等
bartowski 上传的大量 GGUF 格式模型被广泛用于 llama.cpp、Ollama、LM Studio 等本地推理工具中
Ollama、vLLM、llama.cpp等本地推理工具链趋于成熟,让单张消费级GPU也能运行70亿至130亿参数量级的模型
Ollama与llama.cpp是目前在Apple Silicon上使用最广泛的本地推理工具
40 more timeline events
All Facts (20)
OpenCode是一个开源的命令行配置型AI编码智能体工具,支持自定义模型和插件扩展
90%VerifiedOllama将本地模型部署简化为一条命令行指令,并提供与OpenAI兼容的本地API接口
80%VerifiedOpen WebUI 支持 Ollama 和 OpenAI API 等多种后端
80%VerifiedOllama底层基于llama.cpp的推理引擎,原生支持GGUF格式的量化模型
80%VerifiedOllama支持Llama 3、Mistral、Gemma、Qwen等主流开源模型
80%VerifiedSpring AI支持OpenAI、Anthropic、Ollama等多种模型提供商,提供统一的API抽象层
80%VerifiedOllama是一款开源的本地大模型运行框架,支持在个人电脑上一键部署各种开源大语言模型
80%VerifiedSpring AI 通过定义统一的 ChatModel、EmbeddingModel 等核心抽象接口,让上层业务代码与具体模型实现解耦
80%VerifiedOllama支持macOS、Linux、Windows跨平台运行
80%VerifiedOllama内置了与OpenAI兼容的REST API,默认端口为11434
80%VerifiedOllama提供类似Docker的一键式模型管理体验,vLLM通过PagedAttention实现高吞吐量批量推理,LM Studio面向桌面用户提供图形化界面
75%Verified推理框架如 vLLM、llama.cpp、TGI 可用于开放权重模型的本地部署
75%VerifiedGGUF 已成为 llama.cpp、Ollama、LM Studio 等主流本地推理工具的事实标准格式
75%VerifiedOllama提供标准API接口,支持Python、Java、Rust等多种编程语言调用
75%VerifiedOllama本身完全免费且开源
75%VerifiedOllama提供命令行(CLI)和Web UI两种交互方式
70%VerifiedOllama基于llama.cpp项目构建,后者由Georgi Gerganov开发
70%VerifiedOllama安装后默认监听地址为localhost:11434
70%Verified本地部署大模型的最大意义在于数据不出域,敏感日志、告警和内部信息不会上传至第三方
65%VerifiedDify兼容OpenAI、Anthropic、本地Ollama等主流模型接入方式
65%