[控场AI]

#RAG

共 151 篇相关文章

Qwen3+RAGFlow零成本搭建本地知识库全流程教程
·9 分钟

Qwen3+RAGFlow零成本搭建本地知识库全流程教程

手把手教你用Ollama、Qwen3和RAGFlow零成本搭建本地知识库智能助手,从Docker环境配置、模型集成到向量检索全流程详解,消除大模型幻觉,数据隐私可控,小白也能上手。

阅读全文 →
入门聊天机器人开发:RAG技术栈需要哪些编程语言
·4 分钟

入门聊天机器人开发:RAG技术栈需要哪些编程语言

想用 RAG 技术开发聊天机器人却不知从何学起?本文梳理 Python、JavaScript 等编程语言的选择逻辑,解析 RAG 技术栈核心流程,并给出新手学习资源与实践建议。

阅读全文 →
RAG中的Embedding模型详解:从知识库构建到相似度检索全流程
·6 分钟

RAG中的Embedding模型详解:从知识库构建到相似度检索全流程

本文详解 RAG 中 Embedding 模型的工作机制:从知识库分块构建、文本转向量存储,到用户查询检索 top-k 相关文档并拼接提示词的全流程,并说明为什么相关性与 Embedding 微调是决定 RAG 效果的关键。

阅读全文 →
上下文优化的隐藏风险:被丢弃的证据谁来测试?
·6 分钟

上下文优化的隐藏风险:被丢弃的证据谁来测试?

上下文优化不只是压缩问题。本文剖析大模型 context 裁剪中的隐性风险——被丢弃的关键证据如何被平均指标掩盖,并介绍 Reef Infra 的实验闭环、选择策略与覆盖率测试思路。

阅读全文 →
为什么大模型应用离不开LangChain?框架入门核心概念详解
·6 分钟

为什么大模型应用离不开LangChain?框架入门核心概念详解

为什么会调 API 还要学 LangChain?本文从工程化落地角度解析 LangChain 的核心价值,详解提示词模板、Chains、Memory、RAG、Agent 五大模块及企业真实应用场景,帮你理清从调 API 到做产品的关键差距。

阅读全文 →
DeepSeek+RAGFlow本地部署个人知识库全流程教程
·8 分钟

DeepSeek+RAGFlow本地部署个人知识库全流程教程

手把手教你用 Ollama+DeepSeek+RAGFlow 在本地部署个人知识库,涵盖 RAG 与 Embedding 原理、环境变量配置、Docker 部署及在线模型切换方案,零基础也能上手。

阅读全文 →
Spring AI 2.0实战:用Cursor打造AI智能OA办公系统
·6 分钟

Spring AI 2.0实战:用Cursor打造AI智能OA办公系统

基于 Spring AI 2.0 的 AI 智能办公 OA 系统实战项目解析:涵盖 RAG 增强检索、AI 智能填单、大模型工具调用与多级审批流程,全程使用 Cursor AI 编程开发,适合 Java 工程师学习大模型应用落地。

阅读全文 →
RAG系统深度解析:企业级私有知识库为何没那么简单
·7 分钟

RAG系统深度解析:企业级私有知识库为何没那么简单

RAG(检索增强生成)系统看似简单实则复杂。本文拆解企业级私有知识库搭建全流程:数据加载切片、BGE-M3等开源embedding选型、多路检索与重排序、Agent动态路由及RAGAS评估,揭示RAG入门到实战的真实门槛。

阅读全文 →
AdaMem:让RAG按相关性智能分配记忆token的软压缩新方法
·5 分钟

AdaMem:让RAG按相关性智能分配记忆token的软压缩新方法

AdaMem 是一种相关性引导的 RAG 软压缩框架,通过查询相关的记忆token动态分配,让高相关段落获得更多记忆预算。在六个问答基准上超越均匀分配基线,64倍压缩下相对增益最高达19.7%,推理延迟降低4倍。

阅读全文 →
开源文档智能平台实践:基于RAG的PDF问答与多模型切换
·5 分钟

开源文档智能平台实践:基于RAG的PDF问答与多模型切换

一位开发者开源了基于 RAG 的文档智能问答平台,支持 PDF/DOCX 上传、pgvector 向量检索,并能通过单一配置在 OpenAI 与 Claude 间切换。本文拆解其技术栈、多模型设计与分块检索策略。

阅读全文 →
厌倦手动调优RAG?开源工具Muffakir自动跑实验
·4 分钟

厌倦手动调优RAG?开源工具Muffakir自动跑实验

开发者厌倦手动调优RAG流水线,打造开源实验运行器Muffakir。支持分块、嵌入、检索、重排序、top-k等组件的自动化组合实验,并用检索/生成指标、延迟和成本量化对比,可导出配置到Python。

阅读全文 →
从零搭建RAG知识库问答系统:接入DeepSeek的实战全流程
·5 分钟

从零搭建RAG知识库问答系统:接入DeepSeek的实战全流程

手把手教你搭建RAG私有知识库问答系统,接入DeepSeek大模型,用Python后端和原生前端实现文档上传、本地索引、检索增强生成的完整流程,适合入门开发者理解智能体内部原理。

阅读全文 →
AI热点争论:RAG已死?Skills取代MCP了吗?
·4 分钟

AI热点争论:RAG已死?Skills取代MCP了吗?

GitHub Podcast 探讨三大 AI 热点争论:AI 生成的代码是否需要逐行阅读、RAG 检索增强生成是否已经过时、Anthropic Skills 是否会取代 MCP 协议。本文结合行业背景深度解读这些话题的本质。

阅读全文 →
FAISS向量搜索实战入门:从Embedding到RAG的踩坑心得
·5 分钟

FAISS向量搜索实战入门:从Embedding到RAG的踩坑心得

一位开发者分享FAISS向量搜索的实战入门心得,讲解从Embedding到RAG的完整数据流,并深入探讨人名、日期、过滤条件和对话历史等真实场景下的检索难点与应对方案。

阅读全文 →
三个月AI大模型学习路线:从小白到Agent实战全拆解
·4 分钟

三个月AI大模型学习路线:从小白到Agent实战全拆解

一份从零学大模型的三阶段路线:先掌握提示词与API做文案生成器,再学RAG搭建知识库问答助手,最后上手ReAct模式和多Agent协作做智能体实战。适合想转型AI应用开发的入门者参考。

阅读全文 →
RAG知识库搭建全解析:从原理到优化的完整流程
·7 分钟

RAG知识库搭建全解析:从原理到优化的完整流程

本文系统梳理RAG知识库搭建的完整流程,从检索增强生成原理讲起,覆盖向量数据库选型、数据切片、embedding模型、检索器组合、重排序等核心优化环节,帮助开发者搭建低幻觉的私有知识库系统。

阅读全文 →
AI Agent工业级开发指南:从Demo到能扛业务的四层架构
·5 分钟

AI Agent工业级开发指南:从Demo到能扛业务的四层架构

从Demo到工业级AI Agent的完整开发指南:拆解Planner规划、Tools工具调用、Memory记忆三大模块与ReAct循环,讲清智能体四层架构、向量库、RAG落地及企业级稳定性要点。

阅读全文 →
布局感知PDF解析器实战:破解RAG分块难题
·5 分钟

布局感知PDF解析器实战:破解RAG分块难题

一位开发者分享如何用Python和pdfplumber构建布局感知PDF解析器,通过探测视觉网格坐标重建表格与标题结构,解决多栏文档在RAG分块中的语义错乱问题,并对比了坐标提取与视觉模型的取舍。

阅读全文 →