Unverified50% confidenceSolutionExact time
RAG评估流水线通常拆解为检索质量(Context Precision、Context Recall)、生成质量(Faithfulness、Answer Relevancy)和端到端质量三个维度
1
Sources
50%
Confidence
Long-term
Relevance
8/28/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedSonarQube的Quality Gate机制会在代码扫描结果未达预设阈值时自动中断Jenkins流水线并标记失败63% similarUnverifiedRAG系统召回率评估应使用Recall@K、MRR、NDCG等量化指标进行闭环评估62% similarUnverifiedRAGAS评测框架提出了四个核心指标:Faithfulness(忠实度)、Answer Relevancy(答案相关性)、Context Precision(上下文精确度)和Context Recall(上下文召回率)62% similarUnverified企业级Agent评估常见维度包括准确性、相关性、忠实度(Faithfulness,RAG场景)、安全性,实际工程中将LLM自动评估与小规模人工标注结合构建持续评估流水线61% similarUnverifiedLLM评估需同时考量事实准确性、指令遵循度、有害性、有用性和表达质量等多个维度,这些维度之间常存在张力60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/813714API
curl https://kongchang.com/api/v1/knowledge/claims/813714MCP
get_claim(id=813714)