共 173 篇相关文章

详解如何将散落的自动化脚本整合为本地AI Agent智能中枢。涵盖Function Calling核心机制、Ollama+Qwen2.5本地部署方案、工具编排架构设计及完整落地路线图,适合独立开发者和小团队。

24GB内存Mac Mini运行本地大模型太慢?本文分析14B模型在Mac Mini上慢的原因,推荐适合Home Assistant等场景的3B-8B模型选型方案,并提供Ollama推理速度优化的实用建议。

MLflow 3.15.0带来三大核心更新:MCP Registry统一管理Agent工具生态、更智能的Assistant降低开发摩擦、Multimodal Judges支持多模态评估。深入解析这些功能如何提升AI Agent开发体验。

系统提示词是驱动LLM应用的核心组件,却常常缺乏版本控制和回归测试。本文探讨如何通过版本化、结构化拆分、回归测试和代码评审,将提示词纳入完整的工程管理闭环,避免提示词退化和指令冲突。

详解如何用Ollama本地部署大模型,结合Qwen-Agent构建私人AI助手。涵盖RAG知识接入、语音交互、权限隔离等核心技术,提供完整实现路线图,兼顾能力与安全的本地AI Agent架构设计。

一款无需Python环境的命令行工具,支持在本地完成文本、图像、视频、音乐和3D内容生成。了解这款多模态CLI工具的技术思路、优势与局限,以及本地AI工具化的发展趋势。

本地部署大模型在Agent框架中频繁崩溃或卡顿?问题可能出在num_gpu参数设置过高。本文解析num_gpu的真实含义(GPU层卸载而非显卡数量),揭示显存争夺导致KV Cache溢出的机制,并提供实用调优方案。

深入解析Chrome内置AI技术,探讨浏览器本地运行AI模型如何实现数据零上传、即时响应,并通过时尚推荐实例展示端侧AI在隐私保护和开发成本方面的优势。

Kimi K3 模型正式登陆 Ollama Cloud,被标注为「超高用量」类别。本文解析 Kimi K3 的免费调用额度、云端推理体验、技术优势,以及开发者如何通过 Ollama 统一接口无缝调用这款高性能大语言模型。

HuggingHack发布重磅更新,新增S3/MinIO对象存储支持、Ollama与vLLM双引擎智能调度、GGUF格式检查及本地账户系统,全方位提升本地化大语言模型管理能力,助力团队私有化部署与多用户协作。
每日AI新鲜事·07月27日午间版:AI成本分析工具与Kimi K3开源
2026年07月27日午间版 AI新闻速递+热点深度讨论

SayIt是一款开源AI语音输入工具,支持本地模式、云API及服务器三种部署方式,兼容DeepSeek、通义千问等主流大模型,可自定义润色Prompt,是Typeless的理想自托管替代品。
TradingSpy:本地优先开源AI交易助手,数据隐私不妥协
TradingSpy是一款本地运行、隐私优先的开源AI交易助手,无需上传数据至云端。本文深度解析其架构设计、开源价值与局限性,帮助交易者评估是否适合自己的需求。

MLE转SWE还是坚守建模方向?本文深度解析机器学习工程师与软件工程师的核心差异、职业路径选择逻辑,帮助你找到最具竞争力的差异化定位,而非在错误的赛道上内耗。

全面解析Spring AI核心模块:ChatModel对话、EmbeddingModel向量化、RAG检索增强生成、Tool Calling工具调用及MCP协议。Java开发者快速接入DeepSeek、ChatGPT等大模型的实战教程,涵盖Milvus向量数据库与Ollama本地模型集成。

手把手教你用Docker在本地私有化部署Dify AI应用平台。涵盖Linux、Windows、macOS环境配置,docker compose一键启动,首次初始化全流程,30分钟完成企业级AI开发环境搭建。

手把手教你用Ollama+Dify搭建本地企业级RAG知识库,涵盖模型安装、IP监听配置、自定义微调模型导入、Embedding向量检索全流程,彻底摆脱云端API依赖,保障数据安全。

通过 Ollama 开源方案,将 Claude Code 等 AI 编程工具指向本地运行的开源模型,解锁 DeepSeek、Qwen3、Gemma 等数百个模型,在保持原有工作流不变的前提下,将 API 使用成本降至接近于零。本文详解配置方法、硬件要求与竞品对比。

手把手教你将ChatGPT桌面端接入本地大模型,实现零成本、无限Token、数据完全本地化。涵盖Ollama直连方案与CC Switch中转方案,兼容LM Studio、llama.cpp、vLLM,同样适用于Claude Code等AI智能体。
llmfit:一条命令检测硬件能跑哪些本地大模型
llmfit 是用 Rust 编写的开源命令行工具,无需下载模型即可预判本地硬件能否运行指定 LLM。覆盖数百种模型与 Ollama、llama.cpp 等主流推理后端,帮助开发者在本地部署大模型前快速完成硬件适配评估,避免反复试错。