[控场AI]

#本地部署

共 242 篇相关文章

Ollama本地大模型部署入门:中文手册助你少走弯路
·3 分钟

Ollama本地大模型部署入门:中文手册助你少走弯路

不会安装 Ollama 本地大模型?本文介绍一份覆盖安装部署、模型下载、Modelfile 定制、OpenAI 兼容接口和 GGUF 量化的中文手册,帮新手和开发者快速上手本地大模型,少走弯路。

阅读全文 →
Ollama本地部署教程:加速下载与AI角色提示词实践
·4 分钟

Ollama本地部署教程:加速下载与AI角色提示词实践

本地部署Ollama大模型完整教程:解决海外服务器下载缓慢问题,并分享一套前后台分离的AI角色扮演提示词设计思路,含DeepSeek实测效果与人设改写技巧。

阅读全文 →
NVIDIA PAIR:把家里闲置算力串成本地AI集群
·4 分钟

NVIDIA PAIR:把家里闲置算力串成本地AI集群

NVIDIA PAIR 是一款免费软件,能把家中闲置电脑的算力整合成本地AI算力池,自动调度智能体任务,支持Apple设备,主打本地运行与隐私保护。

阅读全文 →
M6 Mac Mini 32GB 跑本地大模型:自托管场景实战分析
·6 分钟

M6 Mac Mini 32GB 跑本地大模型:自托管场景实战分析

M6 Mac Mini 32GB 内存能否胜任本地大模型推理?本文结合 Home Assistant、Frigate、Ollama 等自托管场景,分析模型选型、内存占用与速度表现,帮你判断这套本地 LLM 方案是否合理。

阅读全文 →
12GB显卡跑Qwen3.8-Flash-Next:自研引擎实现65 tok/s
·6 分钟

12GB显卡跑Qwen3.8-Flash-Next:自研引擎实现65 tok/s

开发者用自研Strata推理引擎在12GB RTX 5070上运行Qwen3.8-Flash-Next,输出速度达65 tok/s,比llama.cpp提升近4倍。附完整量化性能数据、硬件配置与开源地址。

阅读全文 →
本地跑 Qwen-3.8-27B 替代 API:一位开发者的实战体验
·5 分钟

本地跑 Qwen-3.8-27B 替代 API:一位开发者的实战体验

一位 Reddit 开发者分享用本地 Qwen-3.8-27B 完全替代云端 API 的实战经验,涵盖 Q4_K_S 量化、Pi agent 极简工具链、树莓派部署与详细成本核算,探讨开源大模型「够用」的临界点。

阅读全文 →
Colibri纯C引擎爆火:25GB内存跑744B大模型
·8 分钟

Colibri纯C引擎爆火:25GB内存跑744B大模型

开源项目Colibri(蜂鸟)纯C编写、零依赖,已获约3.6万星标,通过VRAM/内存/磁盘三级调度,让744B参数MoE大模型在25GB内存的消费级机器上流式运行,支持GLM、Kimi、DeepSeek等9大模型家族本地部署。

阅读全文 →
8G显存本地跑通MiniMax H3:ComfyUI整合包实测
·7 分钟

8G显存本地跑通MiniMax H3:ComfyUI整合包实测

MiniMax H3 海螺开源视频模型 8G 显存本地部署实测,基于秋叶 ComfyUI 整合包和 4步 Lora 提速,附四类模型下载、关键参数设置与效果分析,一键解压即用,免费无排队。

阅读全文 →
开源本地决策模型:比云端API快近20倍
·3 分钟

开源本地决策模型:比云端API快近20倍

开源本地决策模型Laya专注快速判断,实测速度比云端API快近20倍,延迟低至9毫秒,一条命令即可部署,数据不出本机,采用MIT协议免费开源,适合工单分类、流失预警等高频决策场景。

阅读全文 →
Jev模型开源平替:CPU/GPU本地一键部署实测
·5 分钟

Jev模型开源平替:CPU/GPU本地一键部署实测

Jev(Jave)概率预测模型社区开源平替本地部署教程:支持 CPU/GPU 推理、离线运行、一键部署包安装流程与 Web UI 实测,并可通过 API 接入集成。

阅读全文 →
ComfyUI+Seedance本地部署AI漫剧:素材评估与避坑指南
·4 分钟

ComfyUI+Seedance本地部署AI漫剧:素材评估与避坑指南

本文解析一则以ComfyUI+Seedance本地部署AI漫剧为卖点的B站教程视频,剖析其本地智能体自动化工作流的真实内容、价值与局限,并给出面对此类引流教程的避坑建议。

阅读全文 →
本地部署开源Laya实战:搭建环境并运行三个AI客服分类演示
·7 分钟

本地部署开源Laya实战:搭建环境并运行三个AI客服分类演示

开源项目 Laya 本地部署完整实战:从虚拟环境搭建、模型下载到三个客服文本分类演示,涵盖置信度阈值判断与接入本地大模型生成草稿回复,全程 CPU 运行无需 API 密钥。

阅读全文 →
YuE2歌曲生成模型Windows本地部署完整教程
·6 分钟

YuE2歌曲生成模型Windows本地部署完整教程

YuE2(月二)是香港团队推出的开源AI歌曲生成模型,对标Suno。本教程详解如何在Windows系统用ComfyUI便携版配合低显存消费级显卡(如2080Ti)本地部署YuE2,包含硬件要求、生成管线、冒烟测试及常见问题解答。

阅读全文 →
Qwen3 27B本地实测:小模型智能体能力反超Opus旗舰
·10 分钟

Qwen3 27B本地实测:小模型智能体能力反超Opus旗舰

海外博主深度实测Qwen3 27B本地开源模型,在SWE-bench Pro、OS World等智能体任务上反超Opus旗舰闭源模型。本文详解其架构特性、部署方案(Ollama/LM Studio)及与Hermes Agent组合的本地智能体栈搭建。

阅读全文 →
RTX 5060 Ti 16GB 本地 LLM 选型指南:Ollama 模型实测推荐
·5 分钟

RTX 5060 Ti 16GB 本地 LLM 选型指南:Ollama 模型实测推荐

RTX 5060 Ti 16GB 显卡能跑哪些本地大模型?本文结合 Ollama 部署场景,从显存承载能力到编程、推理、设计生成的模型推荐,给出实用的本地 LLM 选型与调优指南。

阅读全文 →
10分钟用Python搭建完全本地的AI智能体教程
·6 分钟

10分钟用Python搭建完全本地的AI智能体教程

本教程演示如何用 Ollama 和 Pydantic AI,几十行 Python 代码搭建完全本地运行的AI智能体,涵盖模型选择、工具函数定义和主循环编写,实现离线、免费、隐私安全的智能体应用。

阅读全文 →
M5 Ultra 512GB内存为何跑不快?带宽才是AI性能瓶颈
·7 分钟

M5 Ultra 512GB内存为何跑不快?带宽才是AI性能瓶颈

M5 Ultra 拥有 512GB 统一内存却只有 1.2TB/s 带宽,本文拆解为何内存带宽才是本地大模型推理的真正瓶颈,并对比 NVIDIA RTX Pro 6000,分析这台苹果 AI 神机的尴尬之处。

阅读全文 →
DGX Spark 对决 Mac Studio M5 Ultra:本地跑AI该选谁?
·7 分钟

DGX Spark 对决 Mac Studio M5 Ultra:本地跑AI该选谁?

DGX Spark 与 Mac Studio M5 Ultra 谁更适合本地跑AI大模型?本文从内存带宽、Pre-Fill/Decode推理阶段、MoE模型、多机扩展与软硬件生态五个维度深度对比,帮你做出选择。

阅读全文 →