Attaque par porte dérobée
term_id: backdoor_attack
Category: ethics_safety
Definition
Une attaque par porte dérobée implique d’empoisonner les données d’entraînement d’un modèle d’apprentissage automatique avec des motifs spécifiques, appelés déclencheurs. Bien que le modèle fonctionne normalement sur des données propres, il active des compo
Summary
Une menace de sécurité où des acteurs malveillants intègrent des déclencheurs cachés dans les modèles d’IA pendant l’entraînement pour provoquer des erreurs de classification spécifiques.
Key Concepts
- Empoisonnement des données
- Intégrité du modèle
- Apprentissage automatique adversarial
- Motifs de déclenchement
Use Cases
- Tests de sécurité des pipelines ML
- Développement de filtres défensifs
- Audit de modèles tiers