RAG evaluators: groundedness vs relevance vs retrieval vs F1 vs response completeness

This sheet compares Groundedness, Relevance, Retrieval, F1 Score, Response Completeness.

CriterionGroundednessRelevanceRetrievalF1 ScoreResponse Completeness
MeasuresResponse aligns with supplied contextResponse addresses the queryRetrieved chunks are relevant to the queryToken overlap vs ground truthCoverage of expected information

The verdict, the full comparison, 5 rules and 1 traps are part of AI-300 access. Unlock AI-300.