RAG evaluators: groundedness vs relevance vs retrieval vs F1 vs response completeness
This sheet compares Groundedness, Relevance, Retrieval, F1 Score, Response Completeness.
| Criterion | Groundedness | Relevance | Retrieval | F1 Score | Response Completeness |
|---|---|---|---|---|---|
| Measures | Response aligns with supplied context | Response addresses the query | Retrieved chunks are relevant to the query | Token overlap vs ground truth | Coverage of expected information |
The verdict, the full comparison, 5 rules and 1 traps are part of AI-300 access. Unlock AI-300.