Incitation sans exemple
Definition
L’incitation sans exemple consiste à demander à un modèle de langage pré-entraîné …
Terms tagged with NLP
L’incitation sans exemple consiste à demander à un modèle de langage pré-entraîné …
XLM-RoBERTa (Cross-lingual Language Model RoBERTa) est un modèle multilingue à grande …
WordPiece est une méthode de tokenisation largement utilisée dans les modèles de …
La détection de toxicité utilise des techniques de traitement automatique du langage …
La toxicité dans l’IA fait référence à la génération ou à la propagation de contenu …
La génération de texte est un paradigme d’application fondamental en traitement du …
La classification de texte est une tâche d’apprentissage supervisé où les …
L’étiquetage de séquence consiste à prédire une étiquette catégorielle pour chaque …
Le pliage sémantique désigne le processus de compression d’embeddings vectoriels …
La similarité de phrases mesure le degré de chevauchement sémantique entre deux phrases …
Les transformateurs de phrases sont des extensions des modèles de type Transformer …
Elle va au-delà de la structure syntaxique pour interpréter l’intention et la …
Qwen3.5 désigne une version spécifique de la lignée Qwen développée par Alibaba Cloud. …
Qwen représente une famille de grands modèles linguistiques avancés créés par le …
Pythia est une série de grands modèles de langage (LLM) open-source créés par EleutherAI, …
Ce terme englobe les produits commerciaux et de recherche créés par OpenAI, un …
Un agent pédagogique est un composant logiciel, souvent incarné sous forme de personnage …
La paraphrase en Traitement Automatique du Langage Naturel (TALN) implique la génération …
Le P-Tuning (Prompt Tuning) est une technique conçue pour adapter de grands modèles de …
La reconnaissance optique de caractères (ROC) utilise le traitement d’image et des …
L’identification de la langue maternelle (NLI) est un sous-domaine du traitement …
Les modèles multilingues sont conçus pour gérer des entrées linguistiques diverses sans …
La génération de masques consiste à produire des masques spatiaux ou temporels qui …
Ce domaine combine les techniques d’apprentissage automatique avec le traitement du …
Dans le contexte de la terminologie moderne de l’IA, Lyra désigne souvent des …
MAUVE est une mesure statistique conçue pour évaluer à quel point la sortie d’un …
Le contexte long désigne la capacité des modèles basés sur des transformateurs à gérer …
Ancrée dans la théorie des actes de parole et la pragmatique, cette perspective met …
Le paradigme « LLM comme juge » consiste à utiliser un grand modèle de langage comme …
Les méthodes d’embedding de graphe de connaissances, telles que TransE ou DistMult, …
La Reconnaissance Intelligente de Mots désigne les technologies avancées de …
Generative Pre-trained Transformer 2 (GPT-2) est un modèle de langage autorégressif qui …
GPT-5.6 fait référence à une version spéculative ou à venir dans la lignée des Modèles de …
Le remplissage de masque est un objectif d’apprentissage préliminaire fondamental …
ExBERT offre une interprétabilité au modèle transformateur BERT en analysant …
La classification de documents est une tâche fondamentale du traitement automatique du …
ELMo génère des embeddings de mots sensibles au contexte en traitant le texte …
TriviaQA est un jeu de données conçu pour la réponse aux questions à domaine ouvert, …
Le jeu de données WikiHow comprend environ 60 000 articles explicatifs collectés depuis …
Wikipédia est l’une des collections de connaissances humaines les plus vastes et …
Le jeu de données Yahoo Answers Topics est un sous-ensemble du plus grand archive de …
S2ORC est un corpus complet d’articles scientifiques dérivé de Semantic Scholar. Il …
Le jeu de données Altlex est composé de paires de phrases partageant le même sens …
Les jeux de données de compression de phrases consistent en des paires où la phrase cible …
Quora Question Pairs (QQP) est un jeu de données de classification binaire contenant plus …
BookCorpus est une collection de textes provenant de plus de 10 000 livres non publiés, …
Les champs aléatoires conditionnels (CRF) sont une classe de modèles discriminatifs …
L’humour computationnel étudie comment les machines peuvent produire ou interpréter …
La connaissance commune fait référence à la vaste quantité d’informations …
Ce concept se concentre sur la manipulation du texte où l’unité fondamentale de …
Bien qu’il fasse historiquement référence à la taxonomie éducative de Benjamin …
BERT est une technique d’apprentissage automatique basée sur les transformateurs …
Cette technique de traitement du langage naturel représente le texte comme un ensemble …
Les scribes médicaux automatisés utilisent le traitement automatique du langage naturel …
Le terme ASR-complet signifie qu’un système de Reconnaissance Automatique de la …
Les modèles Vision-Language, souvent appelés grands modèles de langage multimodaux …
La traduction en IA fait référence à la traduction automatique neuronale, où les modèles …
La synthèse de texte réduit de grands volumes de texte en versions plus courtes sans …
La recherche sémantique interprète l’intention et la signification contextuelle …
Étant donné que les transformateurs traitent tous les tokens en parallèle plutôt que …
La réponse aux questions (QA) consiste à récupérer ou générer des réponses exactes aux …
La reconnaissance d’entités nommées (NER) est une sous-tâche de l’extraction …
Ces modèles mappent des données de haute dimension dans un espace vectoriel continu de …
Dans les modèles de séquence à séquence, le décodeur prend le vecteur de contexte produit …
L’encodage par paires d’octets (BPE) est une technique de compression de …
L’apprentissage auto-supervisé est un sous-ensemble de l’apprentissage …
L’apprentissage avec peu d’exemples permet aux modèles d’apprentissage …
Introduit dans l’article « Attention Is All You Need », l’architecture …
Les jets sont les blocs de construction fondamentaux des données d’entrée en TALN, …
La jetonnisation est une étape critique de prétraitement en Traitement Automatique du …
L’analyse sémantique en IA se concentre sur la compréhension du sens sous-jacent …
Une invite sert d’interface principale pour interagir avec les grands modèles de …
Le pré-entraînement est une technique fondamentale en apprentissage profond où un modèle …
Dans les contextes de communication numérique et de données IA, un ‘post’ …
Le Traitement du Langage Naturel (TLN ou NLP en anglais) est un sous-domaine de …
L’attention multi-têtes étend le mécanisme d’attention standard en …
Dans le contexte de l’IA, « long » décrit souvent la capacité à traiter des entrées …
Les grands modèles de langage (LLM) sont des systèmes d’intelligence artificielle …
Bien que ce ne soit pas un terme algorithmique technique en IA, « au lieu de » est …
Les systèmes d’IA hiérarchiques organisent l’information ou le contrôle selon …
En intelligence artificielle, la génération désigne la capacité des modèles, en …
En traitement automatique du langage naturel, le contexte est crucial pour résoudre les …
Les embeddings sont des représentations vectorielles denses de données où les relations …
Un mécanisme d’attention permet à un modèle de pondérer dynamiquement …