Attaque par porte dérobée

term_id: backdoor_attack

Category: ethics_safety

Definition

Une attaque par porte dérobée implique d’empoisonner les données d’entraînement d’un modèle d’apprentissage automatique avec des motifs spécifiques, appelés déclencheurs. Bien que le modèle fonctionne normalement sur des données propres, il active des compo

Summary

Une menace de sécurité où des acteurs malveillants intègrent des déclencheurs cachés dans les modèles d’IA pendant l’entraînement pour provoquer des erreurs de classification spécifiques.

Key Concepts

  • Empoisonnement des données
  • Intégrité du modèle
  • Apprentissage automatique adversarial
  • Motifs de déclenchement

Use Cases

  • Tests de sécurité des pipelines ML
  • Développement de filtres défensifs
  • Audit de modèles tiers