跳到正文
Mistral AI·· 2025-04-09AI 评分35

Mistral 如何用 LLM as a Judge 评估 RAG 系统

Evaluating RAG with LLM as a Judge

AI 导读

Mistral 提出用 LLM as a Judge 配合结构化输出实现 RAG Triad 评估框架,从上下文相关性、有据性和答案相关性三个维度打分。该框架由 TruLens 提出,RAGAS 等类似方案也已出现,用于端到端评估 RAG 系统的检索与生成质量。Mistral 模型可同时充当生成器和评判器,结构化输出让评分标准可复用且易于机器读取。

来源:Mistral AI · mistral.ai