LM Studio
LM Studio是一款面向本地环境的大型语言模型运行软件,支持用户在个人计算机上下载、管理和运行开源大语言模型,无需依赖云端服务。其提供图形化操作界面,降低本地部署门槛,同时内置兼容OpenAI API格式的本地服务器功能,便于开发者将本地模型集成至各类应用中。适用于注重数据隐私或希望离线使用AI能力的个人用户与开发者。
Core Facts
Timeline (last 90 days)
EvoX Agent支持按难度自动切换模型,经济档配DeepSeek等便宜模型,平衡档配GPT-5.6或Kimi K3等,并支持接入本地模型及LM Studio、Ollama
AI编程工具领域中Local-first的实现通常依赖两类路径:本地运行开源大模型(如通过Ollama、LM Studio加载Llama、Mistral),或借助用户本机已安装的CLI工具完成分析逻辑
推动本地部署生态的核心工具包括Ollama、llama.cpp、LM Studio等
该开发者通过 LM Studio 在本地运行 Qwen 模型,并搭配 opencode 作为客户端
本地AI编程的链路由三类角色构成:承载助手的编辑器、加载模型的运行器、决定操作的Agent
LM Studio基于llama.cpp推理引擎构建,支持GGUF格式的量化模型
本地运行AI模型的技术路线通常依赖Ollama、LM Studio等开源框架,将Llama、Mistral等7B至13B参数的开源模型部署在用户本机运行
本地 API 服务器不需要真实 API Key,填任意非空字符串即可绕过客户端格式校验
LM Studio 支持插件扩展,包括 RAG 文件问答、JS 代码沙盒以及接入 MCP 服务器调用工具
普通版 LM Studio 可在 lmstudio.ai/download 页面下载
40 more timeline events
All Facts (20)
GGUF 格式由 llama.cpp 项目引入,专为 CPU 推理场景优化
90%VerifiedGGUF 已成为 llama.cpp、Ollama、LM Studio 等主流本地推理工具的事实标准格式
85%VerifiedOllama提供类似Docker的一键式模型管理体验,vLLM通过PagedAttention实现高吞吐量批量推理,LM Studio面向桌面用户提供图形化界面
80%VerifiedLM Studio 是一款自带图形界面的本地模型工具,将模型搜索、下载、加载、聊天和参数设置整合到图形界面中
75%VerifiedOllama 和 LM Studio 是基于 Llama.cpp 项目催生的衍生工具
70%VerifiedLM Studio提供图形化界面,适合不熟悉命令行的用户
70%VerifiedOllama、LM Studio、vLLM、LocalAI等本地推理框架都兼容OpenAI的Chat Completions API接口
70%Verified在LM Studio中模型必须放置在子文件夹内,否则无法正确读取GGUF模型文件
65%VerifiedOllama、LM Studio等本地模型部署工具的普及降低了搭建智能工作流的门槛
65%VerifiedOllama 的 RESTful API Server 默认监听 localhost:11434
65%VerifiedOllama以命令行工具为核心,通过标准化模型格式GGUF和REST API接口管理运行本地语言模型;LM Studio提供图形化界面
65%VerifiedGroq、Together AI、Mistral以及Ollama、LM Studio等本地部署方案都选择兼容OpenAI的API格式
65%VerifiedOllama、LM Studio等工具降低了本地部署开源模型的门槛
65%UnverifiedAlex AI支持接入云端大模型API(如DeepSeek)和本地部署大模型两种方式
95%UnverifiedLM Studio默认API接口地址为http://localhost:1234/v1
90%UnverifiedLM Studio默认在本地的1234端口提供API服务
90%UnverifiedAnythingLLM通过集成Ollama、LM Studio等本地推理后端实现离线AI能力
90%Unverified自2022年ChatGPT发布以来,GitHub上涌现出大量降低AI使用门槛的开源项目,包括Ollama、LM Studio、One API、NewAPI等
90%UnverifiedGemma 4的26B MOE版本下载大小约为18GB,可通过LM Studio免费应用零代码在本地运行
90%UnverifiedLM Studio可直接从Hugging Face下载GGUF格式模型,并针对不同硬件进行推理加速优化
85%