LLM comme juge

term_id: llm_as_a_judge

Category: application_paradigms

Definition

Le paradigme « LLM comme juge » consiste à utiliser un grand modèle de langage comme évaluateur automatisé de la qualité des sorties d’autres modèles. Au lieu de s’appuyer uniquement sur des annotateurs humains ou des métriques rigi

Summary

Une méthode pour évaluer les sorties des grands modèles de langage en utilisant un autre LLM pour noter ou classer les réponses selon des critères.

Key Concepts

  • Évaluation automatisée
  • Ingénierie des invites
  • Alignement des modèles
  • Indicateurs de qualité

Use Cases

  • Étalonnage des modèles RLHF
  • Évaluation de l’écriture créative
  • Détection de la sécurité et des biais