LLM comme juge
term_id: llm_as_a_judge
Category: application_paradigms
Definition
Le paradigme « LLM comme juge » consiste à utiliser un grand modèle de langage comme évaluateur automatisé de la qualité des sorties d’autres modèles. Au lieu de s’appuyer uniquement sur des annotateurs humains ou des métriques rigi
Summary
Une méthode pour évaluer les sorties des grands modèles de langage en utilisant un autre LLM pour noter ou classer les réponses selon des critères.
Key Concepts
- Évaluation automatisée
- Ingénierie des invites
- Alignement des modèles
- Indicateurs de qualité
Use Cases
- Étalonnage des modèles RLHF
- Évaluation de l’écriture créative
- Détection de la sécurité et des biais