Mistral AI·· 2025-04-09AI 评分24
Mistral 如何用 LLM as a Judge 评估 RAG 系统
Evaluating RAG with LLM as a Judge
AI 导读
Mistral 提出用 LLM as a Judge 结合 RAG Triad 框架评估 RAG 系统,通过 Context Relevance、Groundedness、Answer Relevance 三项指标分别检查检索文档与查询的匹配度、回答是否基于检索上下文以及是否回应原始问题。
来源:Mistral AI · mistral.ai