Mistral AI·· 2025-04-09AI 评分35
Mistral 如何用 LLM as a Judge 评估 RAG 系统
Evaluating RAG with LLM as a Judge
AI 导读
Mistral 提出用 LLM as a Judge 配合结构化输出实现 RAG Triad 评估框架,从上下文相关性、有据性和答案相关性三个维度打分。该框架由 TruLens 提出,RAGAS 等类似方案也已出现,用于端到端评估 RAG 系统的检索与生成质量。Mistral 模型可同时充当生成器和评判器,结构化输出让评分标准可复用且易于机器读取。
来源:Mistral AI · mistral.ai