Tanh
Definition
La fonction tangente hyperbolique (Tanh) est une fonction d’activation non linéaire …
Terms tagged with Deep Learning
La fonction tangente hyperbolique (Tanh) est une fonction d’activation non linéaire …
L’apprentissage de similarité se concentre sur l’entraînement de modèles pour …
Les transformateurs de phrases sont des extensions des modèles de type Transformer …
L’astuce de reparamétrisation est une méthode fondamentale utilisée dans les …
Pyannote Audio est une boîte à outils complète conçue pour faciliter le développement et …
Le Produit d’Experts (PoE) est une méthode permettant de construire des …
L’apprentissage de représentation multimodale consiste à entraîner des modèles à …
Dans les GAN, l’effondrement de mode se produit lorsque le générateur apprend à …
Cette hypothèse explique pourquoi l’apprentissage profond fonctionne efficacement …
Les réseaux autoroutiers sont conçus pour résoudre le problème de la disparition du …
Une couche cachée est constituée de neurones qui reçoivent des entrées des couches …
Le matériel d’IA fait référence aux dispositifs de calcul spécialisés optimisés …
Cette stratégie d’optimisation permet d’entraîner des modèles …
Une Unité Récurrente à Portes (GRU) est une cellule spécialisée de réseau neuronal …
L’apprentissage de fonctionnalités, souvent associé à l’apprentissage …
Les Modèles Basés sur l’Énergie (EBM) définissent une distribution de probabilité …
L’adaptation de domaine répond au défi lorsque les données d’entraînement et …
La double remise en cause le compromis traditionnel biais-variance en montrant que les …
La DP-SGD est une variante de la Descente de Gradient Stochastique conçue pour protéger …
BERT est une technique d’apprentissage automatique basée sur les transformateurs …
Cette méthode ajuste et met à l’échelle les activations pour avoir une moyenne …
AlphaChip est un système d’IA spécialisé conçu pour automatiser et améliorer le …
Les attaques adversariales exploitent les vulnérabilités des réseaux de neurones en …
La vision par ordinateur (Computer Vision) est une branche de l’intelligence …
Les connexions résiduelles, également appelées connexions saut (skip connections), …
La ReLU est largement utilisée dans les réseaux neuronaux profonds en raison de son …
Les RNN sont conçus pour reconnaître des motifs dans des séquences de données, telles que …
Les réseaux LSTM résolvent le problème de disparition du gradient courant dans les RNN …
Dans les réseaux de neurones, le dropout prévient le surapprentissage en supprimant …
Une fonction d’activation introduit une non-linéarité dans un réseau neuronal, lui …
Un modèle pré-entraîné est un modèle d’IA fondamental qui a subi un entraînement …
Les modèles basés sur la diffusion sont une classe d’IA générative qui crée de …
L’apprentissage par transfert exploite des modèles pré-entraînés pour améliorer les …
Le pré-entraînement est une technique fondamentale en apprentissage profond où un modèle …
Un réseau de neurones est une série d’algorithmes qui cherche à reconnaître les …
L’attention multi-têtes étend le mécanisme d’attention standard en …
Les grands modèles de langage (LLM) sont des systèmes d’intelligence artificielle …
Les modèles de diffusion sont une classe d’IA générative qui apprennent à inverser …
Adam (Adaptive Moment Estimation) est un algorithme d’optimisation basé sur le …
L’affinage consiste à prendre un modèle déjà entraîné sur un grand ensemble de …
Les réseaux neuronaux convolutifs (RNC) sont conçus pour apprendre automatiquement et de …
Un mécanisme d’attention permet à un modèle de pondérer dynamiquement …