[控场AI]

#本地部署

共 242 篇相关文章

PyCharm配置本地DeepSeek模型实现AI辅助编程完整教程
教程攻略
·7 分钟

PyCharm配置本地DeepSeek模型实现AI辅助编程完整教程

详细介绍如何通过Ollama在PyCharm中配置本地DeepSeek模型,实现免费、隐私安全的AI辅助编程。包含安装步骤、插件配置、使用技巧及硬件建议。

阅读全文 →
LFM2.5-8B-A1B:1.5B激活参数实现4倍体量效果的MoE模型
科技前沿
·6 分钟

LFM2.5-8B-A1B:1.5B激活参数实现4倍体量效果的MoE模型

Liquid AI发布LFM2.5-8B-A1B模型,采用MoE架构,8B总参数仅激活1.5B,在工具调用场景中媲美6B级模型表现。支持128K上下文、本地部署、多语言,SGLang即时支持。

阅读全文 →
DeepSeek V4 Flash MTP推测解码实测:本地推理提速20%指南
教程攻略
·8 分钟

DeepSeek V4 Flash MTP推测解码实测:本地推理提速20%指南

实测DeepSeek V4 Flash开启MTP推测解码后的性能表现:代码生成场景提速约20%,文本生成提升有限。详解内存开销、准确性差异、Q4与Q3量化对比,以及通过Inference应用和OpenAI兼容API的完整部署教程。

阅读全文 →
Claude Agent SDK+LiteLLM+本地大模型:零成本搭建智能体平台
教程攻略
·9 分钟

Claude Agent SDK+LiteLLM+本地大模型:零成本搭建智能体平台

详解如何通过LiteLLM Proxy将Claude Agent SDK的API请求重定向到本地大模型,在保留完整Agent框架能力的同时将推理成本降为零。含架构设计、实战演示与企业级部署方案。

阅读全文 →
4×3080Ti本地部署千问3.6 27B跑OpenCode编程实测
产品体验
·7 分钟

4×3080Ti本地部署千问3.6 27B跑OpenCode编程实测

使用4张3080Ti 16G魔改显卡本地部署千问3.6 27B FP8模型,配合OpenCode完成系统管理工具开发的完整实测。涵盖硬件配置、推理速度、上下文管理经验及开发效率对比。

阅读全文 →
Ollama本地部署大模型完全指南:断网也能用的AI
教程攻略
·7 分钟

Ollama本地部署大模型完全指南:断网也能用的AI

详解Ollama本地部署开源大模型的完整流程,涵盖安装配置、模型选择、显存要求及实际效果对比。支持Llama 3、通义千问等主流模型,零成本、断网可用,轻松打造私有AI工作站。

阅读全文 →
Bolt.diy本地部署教程:免费开源的AI全栈开发工具
教程攻略
·6 分钟

Bolt.diy本地部署教程:免费开源的AI全栈开发工具

Bolt.diy是Bolt.new的开源替代方案,支持自由接入OpenAI、Claude等大模型,本地部署零订阅费。本文详解安装配置流程、模型选择方案及适用场景,助你低成本实现AI全栈开发。

阅读全文 →
Ollama本地部署大模型教程:安装配置到API调用全流程
教程攻略
·5 分钟

Ollama本地部署大模型教程:安装配置到API调用全流程

详解Ollama本地部署开源大模型的完整流程,涵盖安装配置、模型选择与量化策略、Python代码调用API、性能优化等实战技巧,帮你快速在本地运行Qwen、Llama等大模型。

阅读全文 →
6分钟本地运行Claude Code泄露版教程(零基础可上手)
教程攻略
·2 分钟

6分钟本地运行Claude Code泄露版教程(零基础可上手)

详细图文教程教你6分钟内本地部署运行Claude Code泄露版,无需编程基础,通过Trae IDE和MiniMax API即可完成安装配置,体验专业级AI编程能力。

阅读全文 →
DeepSeek V4深度解析:编码能力全面超越GPT-4.0的三大核心技术
产品体验
·4 分钟

DeepSeek V4深度解析:编码能力全面超越GPT-4.0的三大核心技术

DeepSeek V4模型深度技术解析:百万级上下文窗口、N-gram记忆架构、MHC流形约束超连接三大突破,编码基准全面超越Claude和GPT-4.0,成本仅为竞品十分之一,支持双RTX 4090本地部署。

阅读全文 →
免费使用Claude Code:CC Switch+Ollama本地模型驱动AI编程Agent教程
教程攻略
·6 分钟

免费使用Claude Code:CC Switch+Ollama本地模型驱动AI编程Agent教程

详细教程教你通过CC Switch将本地Ollama模型伪装成Claude API,零成本驱动Claude Code桌面版进行AI编程。涵盖安装配置、模型选择、实测效果,支持千问、Gemma等开源模型。

阅读全文 →
Docker Model Runner使用教程:一条命令本地运行AI模型
教程攻略
·6 分钟

Docker Model Runner使用教程:一条命令本地运行AI模型

详解Docker Model Runner的安装配置与实战用法,通过Docker Compose集成本地AI模型,兼容OpenAI API接口,实现零配置本地部署LLM大模型,附完整聊天应用开发示例。

阅读全文 →
QwenCoder本地部署实测:能否替代付费AI编程助手?
产品体验
·5 分钟

QwenCoder本地部署实测:能否替代付费AI编程助手?

实测QwenCoder 80B本地部署效果,对比Gemini、Claude等付费AI编程工具。详解硬件配置、LM Studio部署方案及实际编程能力测试结果,帮你判断本地模型能否省下AI订阅费。

阅读全文 →
DeepSeek本地部署教程:Ollama一键安装运行指南
教程攻略
·7 分钟

DeepSeek本地部署教程:Ollama一键安装运行指南

详细讲解如何通过Ollama在本地部署DeepSeek R1大模型,包括安装步骤、模型版本选择、硬件配置要求及进阶玩法,零基础10分钟搞定私有化AI部署。

阅读全文 →
本地部署大模型怎么判断显存爆了?一文看懂显存监控方法
教程攻略
·6 分钟

本地部署大模型怎么判断显存爆了?一文看懂显存监控方法

本地部署大模型时如何判断显存是否爆满?本文详解专用显存与共享GPU内存的区别,教你通过任务管理器快速判断显存溢出,并提供模型量化、上下文长度控制等避免爆显存的实用建议。

阅读全文 →
Qwen3.6量化版本地部署实测:NVFP4、APEX、Q4、Q6哪个最值得选
产品体验
·4 分钟

Qwen3.6量化版本地部署实测:NVFP4、APEX、Q4、Q6哪个最值得选

实测Qwen3.6系列7-8个量化模型在工具调用、命令行操作、Bug修复、数学推理等8大维度的表现,对比NVFP4、APEX、Q4、Q6量化方案,附总分排名与选购建议,帮你找到最适合本地部署的量化版本。

阅读全文 →
Qwen3.6 35B开源实测逼近Claude,xAI语音克隆API正式上线
科技前沿
·3 分钟

Qwen3.6 35B开源实测逼近Claude,xAI语音克隆API正式上线

阿里开源Qwen3.6 35B模型,256专家MoE架构仅需3B激活参数,SWE Bench成绩逼近Claude Opus。xAI发布Voice Cloning API支持28种语言,NVIDIA开源OpenShell安全沙箱,Sam Altman表态模型智力优先。

阅读全文 →
Hermes + Qwen3.6 本地部署教程:零成本搭建私有AI Agent
教程攻略
·6 分钟

Hermes + Qwen3.6 本地部署教程:零成本搭建私有AI Agent

详细教程教你用Hermes Agent搭配Qwen3.6开源大模型,在本地零成本部署私有AI助手。涵盖WSL环境配置、模型下载启动、Telegram机器人对接及开机自启设置,实现无限Token、数据私有的AI Agent体验。

阅读全文 →