[控场AI]

#本地部署

共 242 篇相关文章

Qwen3.6 MTP加速实测:单GPU推理飙到220 token/s
科技前沿
·4 分钟

Qwen3.6 MTP加速实测:单GPU推理飙到220 token/s

Qwen3.6实验性MTP-GGUF版本实测,单GPU将35B-A3B模型推理速度提升至220 token/s,比原版快1.4倍且精度零损失。详解MTP原理、最优Draft Tokens策略及RTX 5090实测数据。

阅读全文 →
本地部署DeepSeek+RAG知识库教程:Ollama+RAGFlow保姆级指南
教程攻略
·6 分钟

本地部署DeepSeek+RAG知识库教程:Ollama+RAGFlow保姆级指南

手把手教你用Ollama本地部署DeepSeek大模型,结合RAGFlow搭建RAG私有知识库。涵盖环境配置、Docker部署、Embedding原理讲解,支持离线运行,保障数据隐私,轻松实现企业级智能问答。

阅读全文 →
RAGFlow本地部署教程:Docker搭建企业级RAG知识库全流程
教程攻略
·3 分钟

RAGFlow本地部署教程:Docker搭建企业级RAG知识库全流程

详解RAGFlow本地部署全流程,涵盖RAG技术原理、Docker环境配置、Ollama大模型接入、知识库创建与对话测试。手把手教你从零搭建企业级知识库问答系统,实现数据私有化部署。

阅读全文 →
DeepSeek+RAGFlow本地部署AI知识库教程(2025最新)
教程攻略
·4 分钟

DeepSeek+RAGFlow本地部署AI知识库教程(2025最新)

手把手教你用DeepSeek+RAGFlow+Ollama本地部署个人AI知识库。涵盖RAG原理解析、Ollama安装、Docker部署RAGFlow、知识库创建与调优全流程,数据完全私有,零基础可上手。

阅读全文 →
Anima二次元大模型:6G显存本地部署与工作流配置教程
教程攻略
·6 分钟

Anima二次元大模型:6G显存本地部署与工作流配置教程

详解Anima二次元动漫AI绘图大模型的本地部署方法,仅需6G显存即可流畅运行。涵盖ComfyUI工作流配置、文生图参数设置、高清放大技巧及低显存优化建议,适合中低端显卡用户。

阅读全文 →
Open Design:开源AI设计框架,连接现有编程智能体
产品体验
·6 分钟

Open Design:开源AI设计框架,连接现有编程智能体

Open Design 是本地优先的 Apache 2.0 开源设计框架,支持连接 Claude Code、Cursor、Gemini CLI 等编程智能体,内置19种可组合技能和71套 Design.md 设计系统,实现高质量UI设计生成与本地私有化部署。

阅读全文 →
MoS-TTS-Nano部署教程:0.1B超轻量TTS模型CPU即可运行
教程攻略
·6 分钟

MoS-TTS-Nano部署教程:0.1B超轻量TTS模型CPU即可运行

经实战验证的MoS-TTS-Nano本地部署教程,0.1B参数超轻量TTS语音合成模型无需GPU,四核CPU即可流畅运行。涵盵Conda环境配置、pynini安装踩坑解决、模型下载及Gradio WebUI启动全流程。

阅读全文 →
AnythingLLM:本地部署的全能AI知识库工具深度解析
产品体验
·8 分钟

AnythingLLM:本地部署的全能AI知识库工具深度解析

深度解析AnythingLLM开源项目,一款隐私优先、零配置的本地AI生产力平台。支持RAG文档对话、多模型接入、知识库管理和AI Agent,GitHub近6万星标,适合企业和个人本地部署使用。

阅读全文 →
GPT-OSS 120B/20B开源模型深度测评:幻觉、推理、代码全面实测
产品体验
·9 分钟

GPT-OSS 120B/20B开源模型深度测评:幻觉、推理、代码全面实测

OpenAI开源GPT-OSS 120B和20B模型全面测评,涵盖幻觉测试、逻辑推理、代码生成、SQL查询、文档分析等多维度实测,附部署方式与选型建议,助你选择最适合的开源大模型。

阅读全文 →
OpenAI开源GPT-OSS:16G显存跑O4级模型,部署教程全解析
教程攻略
·9 分钟

OpenAI开源GPT-OSS:16G显存跑O4级模型,部署教程全解析

OpenAI正式开源GPT-OSS系列模型(20B/120B),采用MOE架构+FP4混合精度,单卡4090即可运行O3级推理模型。本文详解核心技术、性能评测及Ollama/vLLM等四种本地部署方案。

阅读全文 →
UI-Tars Desktop实测:安装部署教程与Claude Bot对比评测
产品体验
·9 分钟

UI-Tars Desktop实测:安装部署教程与Claude Bot对比评测

详细实测字节跳动开源AI Agent工具UI-Tars Desktop,手把手教你本地安装配置,完成三项任务测试,并与Claude Bot、NanoBot横向对比,解析其开源免费、本地运行的核心优势与现存不足。

阅读全文 →
Codex+Ollama本地部署教程:零成本搭建AI编程助手
教程攻略
·10 分钟

Codex+Ollama本地部署教程:零成本搭建AI编程助手

手把手教你用Codex搭配Ollama在本地部署免费AI编程助手,涵盖硬件检测、Ollama安装、Gemma/Qwen模型下载与接入配置全流程,轻松实现隐私安全的本地AI编程工作流。

阅读全文 →
Ollama+OpenCode本地部署AI编程:零成本替代Cursor的完整方案
教程攻略
·9 分钟

Ollama+OpenCode本地部署AI编程:零成本替代Cursor的完整方案

详细教程:通过Ollama本地部署千问3 Coder大模型,配合OpenCode开源编程工具,实现零成本AI编程。涵盖环境搭建、代码生成、自动调试全流程,附硬件配置建议。

阅读全文 →
GPT-OSS 120B本地部署实测:代码生成、推理能力全面对比O4 Mini
产品体验
·9 分钟

GPT-OSS 120B本地部署实测:代码生成、推理能力全面对比O4 Mini

实测OpenAI首个开源推理模型GPT-OSS 120B,通过Ollama本地部署,从代码生成、逻辑推理、UI设计等维度全面评测,与O4 Mini深度对比,揭示这款开源模型的真实水平与部署踩坑经验。

阅读全文 →
阿里QwQ-32B开源:32B参数如何媲美671B的DeepSeek R1
深度解读
·8 分钟

阿里QwQ-32B开源:32B参数如何媲美671B的DeepSeek R1

阿里开源推理模型QwQ-32B仅用32B参数,在多项基准测试中媲美甚至超越DeepSeek R1满血版(671B)。本文深度解析其两阶段强化学习训练策略、性能对比数据,以及强化学习带来的能力涌现现象,揭示小参数模型以小博大的核心秘密。

阅读全文 →
GPT-OSS开源模型本地部署教程:实测效果与显存占用分析
教程攻略
·8 分钟

GPT-OSS开源模型本地部署教程:实测效果与显存占用分析

详细介绍OpenAI开源GPT-OSS模型的本地部署全流程,使用Ollama在RTX 4090上实测20B版本的中文理解、逻辑推理等能力表现,分析MoE架构下的显存占用与硬件需求。

阅读全文 →
Whisper本地部署教程:手把手搭建免费语音转文字工具
教程攻略
·12 分钟

Whisper本地部署教程:手把手搭建免费语音转文字工具

详细图文教程教你在本地部署OpenAI Whisper语音识别工具,涵盖Conda环境配置、PyTorch安装、模型选择到实际转录操作全流程,支持近百种语言,免费生成SRT字幕文件。

阅读全文 →
GPT-OSS本地部署教程:Ollama一键运行OpenAI开源模型
教程攻略
·8 分钟

GPT-OSS本地部署教程:Ollama一键运行OpenAI开源模型

详解OpenAI开源模型GPT-OSS的本地部署方法,涵盖20B/120B版本对比、Ollama安装配置、硬件要求及实测效果,助你在家用电脑上离线运行接近ChatGPT水平的AI模型。

阅读全文 →