跳到正文
原文
Mistral AI·· 2025-04-09AI 评分24

Mistral 如何用 LLM as a Judge 评估 RAG 系统

Evaluating RAG with LLM as a Judge

AI 导读

Mistral 提出用 LLM as a Judge 结合 RAG Triad 框架评估 RAG 系统,通过 Context Relevance、Groundedness、Answer Relevance 三项指标分别检查检索文档与查询的匹配度、回答是否基于检索上下文以及是否回应原始问题。

来源:Mistral AI · mistral.ai