跳到正文
原文
Mistral AI:News(网页)·· 2025-04-09AI 评分43

Mistral 如何用 LLM as a Judge 评估 RAG 系统

Evaluating RAG with LLM as a Judge

AI 导读

Mistral 提出用 LLM as a Judge 结合 RAG Triad 框架评估 RAG 系统,从上下文相关性、有据性和答案相关性三个维度打分。其 API 新增的结构化输出功能可定义评分 schema,让评判 LLM 输出机器可读的分数,从而构建更可靠的自动化评估流程。

来源:Mistral AI:News(网页) · mistral.ai