ganloss
Jobs
Training
Companies
Events
Guides
Jobs
Talent
Training
Companies
Guides
Sign in
Sign in
Remote
AI Dev SF
Full-time
Internship
AI PO
Freelance
All tests
LLM & GenAI
Métriques d'évaluation LLM
Choisir la bonne métrique pour valider un assistant RAG avant mise en prod.
0:00
Vous déployez un bot FAQ juridique interne. Quelle métrique prioriser pour éviter les hallucinations factuelles sur les documents sources ?
BLEU score sur les réponses générées
Faithfulness / groundedness (alignement réponse ↔ contexte récupéré)
Perplexité du modèle génératif
Latence P95 de l'inférence
Explain your choices
(optional, recommended)
Submit for grading