Bakdørsangrep

term_id: backdoor_attack

Category: ethics_safety

Definition

Et bakdørsangrep involverer forgiftning av treningsdataene til en maskinlæringsmodell med spesifikke mønstre, kjent som utløsere. Mens modellen fungerer normalt på ren data, aktiverer den feilaktige atferd når utløseren…

Summary

En sikkerhetstrussel der onde aktører legger inn skjulte utløsere i AI-modeller under treningen for å forårsake spesifikke feilklassifiseringer.

Key Concepts

  • Dataforgiftning
  • Modellintegritet
  • Fiendtlige maskinlæringsmetoder
  • Utløsermønstre

Use Cases

  • Sikkerhetstesting av ML-pipelines
  • Utvikling av forsvarsmekanismer
  • Revisjon av tredjepartsmodeller