[控场AI]
产品

rag-eval

一款开源RAG评测工具,核心特性为零依赖、无需API密钥、框架无关,内置本地运行的词法评分器和检索指标,同时支持可选的LLM Judge模式,提供CLI和FastAPI两种使用形态

时间轴 (近 90 天)

9月16日

rag-eval 是一款零依赖、无需API密钥、框架无关的开源RAG评测工具

待验证50%
9月16日

rag-eval 通过标准的 .jsonl 文件接收评测数据,不绑定 Haystack、LangChain、LlamaIndex 等特定框架

待验证50%
9月16日

rag-eval 内置词法层面的 claim-overlap 评分器和基于集合的检索指标两类本地评分方式,完全本地运行、免费

待验证50%
9月16日

rag-eval 支持通过 --judge openai 参数启用大模型作为裁判进行语义验证,作为可选功能

待验证50%
9月16日

rag-eval 提供 CLI 和 FastAPI 微服务两种使用方式,CLI 输出富文本终端表格并支持导出 JSON,FastAPI 提供 /evaluate 接口

待验证50%
9月16日

rag-eval 可通过 pip install rag-eval 命令安装

待验证50%
9月16日

将评测接入 CI/CD 流程,将关键指标与预设阈值对比、超过容忍范围则阻断合并,是 RAG 质量保障自动化的关键做法

待验证50%
9月16日

rag-eval 采用默认本地免费指标初筛、关键节点再启用 LLM Judge 精评的分层评测策略以控制成本

待验证50%
9月16日

rag-eval 的源码托管在 GitHub 的 Mustaaabadshah/rag-eval 仓库

待验证50%

全部知识事实 (9)

来源文章