[控场AI]

#Ollama

共 66 篇相关文章

Ollama v0.40.0-rc2 发布:本地大模型工具的新动向
·2 分钟

Ollama v0.40.0-rc2 发布:本地大模型工具的新动向

Ollama 发布 v0.40.0-rc2 候选版本,本地大模型运行工具迎来新一轮迭代。本文解读该版本的发布状态、Release Candidate 含义及 Ollama 的使用价值。

阅读全文 →
Ollama v0.40.0-rc1 发布:MLX 分词器对齐发布者语义
·5 分钟

Ollama v0.40.0-rc1 发布:MLX 分词器对齐发布者语义

Ollama 发布 v0.40.0-rc1 预览版,核心更新为 MLX 后端分词器对齐发布者语义,涵盖预分词顺序、Unicode 边界、BPE 合并及跨语言测试保障,提升 Apple Silicon 本地推理一致性。

阅读全文 →
Ollama v0.34.4-rc1发布:升级XGrammar 0.2.7优化结构化输出
·3 分钟

Ollama v0.34.4-rc1发布:升级XGrammar 0.2.7优化结构化输出

Ollama发布v0.34.4-rc1候选版本,将mlxrunner的XGrammar升级至0.2.7,修复类型化字典值与短数组的schema处理问题,优化本地大模型结构化输出的可靠性。

阅读全文 →
Ollama v0.35.0-rc0 发布:新增 System One 评分 API
·3 分钟

Ollama v0.35.0-rc0 发布:新增 System One 评分 API

Ollama 发布 v0.35.0-rc0 候选版本,核心新增 System One 评分 API(PR #18606)。本文解读该版本关键变更、RC 版本含义及本地大模型用户的升级建议。

阅读全文 →
Ollama v0.35.0-rc1 发布:MLX 拉取重试优化
·4 分钟

Ollama v0.35.0-rc1 发布:MLX 拉取重试优化

Ollama 发布 v0.35.0-rc1 候选版本,重点优化了 MLX 后端的模型拉取重试机制,引入看门狗中断停滞重试,提升 Apple Silicon 平台本地大模型部署的稳定性。

阅读全文 →
Ollama v0.35.1-rc0 更新:模型能力声明机制详解
·4 分钟

Ollama v0.35.1-rc0 更新:模型能力声明机制详解

Ollama 发布 v0.35.1-rc0 预览版,通过 PR #18708 引入显式模型能力声明机制,用 CAPABILITY 字段替代脆弱的架构元数据匹配,并为 MLX 运行时支持铺路。本文解析本次更新的核心变化与工程意义。

阅读全文 →
Ollama v0.35.1-rc1 发布:新增 Clef 模型支持
·3 分钟

Ollama v0.35.1-rc1 发布:新增 Clef 模型支持

Ollama 发布候选版本 v0.35.1-rc1,核心更新为新增 clef 模型支持。本文解读该版本变更内容、候选版本的使用注意事项,以及 Ollama 作为本地大模型运行工具的生态价值。

阅读全文 →
Ollama 发布 v0.35.1-rc2:本地大模型运行工具的持续迭代
·3 分钟

Ollama 发布 v0.35.1-rc2:本地大模型运行工具的持续迭代

开源本地大模型工具 Ollama 发布 v0.35.1-rc2 候选版本,本次更新修复了 CI 构建上下文缺失问题,并通过 GitHub 验证签名。本文解读该版本改动及 Ollama 的社区价值。

阅读全文 →
Ollama本地部署大模型教程:6G显存也能跑的保姆级指南
·4 分钟

Ollama本地部署大模型教程:6G显存也能跑的保姆级指南

基于B站实操教程,详解如何用Ollama在本地部署大模型,6G显存也能跑。澄清DeepSeek本地部署真相,附按显存选模型指南与完整安装步骤。

阅读全文 →
Moka Chat:一条命令给 Ollama 模型装上 MCP 工具
·5 分钟

Moka Chat:一条命令给 Ollama 模型装上 MCP 工具

Moka Chat 是一款 MIT 开源、本地优先的聊天应用,一条 npx 命令即可为 Ollama 模型接入 MCP 工具,并通过 Inspector 查看每次工具调用的 JSON-RPC、token 与耗时,支持 LM Studio 与托管模型对比。

阅读全文 →
Mac 本地跑 AI 完整教程:Ollama 安装与模型选择指南
·7 分钟

Mac 本地跑 AI 完整教程:Ollama 安装与模型选择指南

手把手教你在 Mac 上免费运行本地 AI 模型:Ollama 引擎安装、终端运行 DeepSeek,以及用 Docker + Open WebUI 搭建 ChatGPT 式界面,附不同内存机型的模型选择建议。

阅读全文 →
本地大模型部署入门:Ollama与vLLM部署qwen3实战解析
·5 分钟

本地大模型部署入门:Ollama与vLLM部署qwen3实战解析

本地大模型部署入门教程:解析Ollama与vLLM两大部署工具的核心差异,梳理显存平衡、高并发、服务化等部署目标,并介绍如何用vLLM部署qwen3-0.6B模型。

阅读全文 →
Ollama本地决策模型来了:Nimble如何实现实时任务路由
·4 分钟

Ollama本地决策模型来了:Nimble如何实现实时任务路由

Ollama宣布支持本地运行的决策模型,并推出Nimble模型与全新/v1/systemone API,可用于工单分流、模型路由和内容审核等实时决策任务。本文解析其功能、应用场景与落地价值。

阅读全文 →
Ollama实战教程:免费本地运行AI大模型全流程
·5 分钟

Ollama实战教程:免费本地运行AI大模型全流程

Ollama完整使用教程:教你在macOS、Windows、Linux上免费安装并本地运行开源AI大模型,详解本地模型与云端模型区别、定价免费额度,以及与Claude Code集成的实操步骤。

阅读全文 →
Ollama计费故障:DeepSeek-V4.1-Flash模型误计费已修复并退还
·3 分钟

Ollama计费故障:DeepSeek-V4.1-Flash模型误计费已修复并退还

Ollama承认其deepseek-v4.1-flash模型出现计费错误,部分用户被按错误费率结算导致超额消耗。官方已重置用量并返还超额用量,本文梳理事件经过、补偿措施及对开发者的启示。

阅读全文 →
Ollama深度拆解:14人团队如何靠分发做成AI界Docker
·8 分钟

Ollama深度拆解:14人团队如何靠分发做成AI界Docker

深度拆解Ollama:14人团队如何靠Docker式分发做成AI界顶流。剖析其双推理后端、KV量化、MTP提速的技术底牌,以及推理层依附上游、量化落后前沿等真实短板与护城河。

阅读全文 →
DeepSeek本地部署实战:Ollama+API调用完整教程
·6 分钟

DeepSeek本地部署实战:Ollama+API调用完整教程

手把手教你用Ollama在本地或云服务器部署DeepSeek大模型,涵盖硬件配置选型、模型下载命令,以及Ollama官方库、requests、OpenAI兼容接口三种API调用方式,小白也能轻松上手。

阅读全文 →
RTX 5060 Ti 16GB 本地 LLM 选型指南:Ollama 模型实测推荐
·5 分钟

RTX 5060 Ti 16GB 本地 LLM 选型指南:Ollama 模型实测推荐

RTX 5060 Ti 16GB 显卡能跑哪些本地大模型?本文结合 Ollama 部署场景,从显存承载能力到编程、推理、设计生成的模型推荐,给出实用的本地 LLM 选型与调优指南。

阅读全文 →