Bakdørsangrep
term_id: backdoor_attack
Category: ethics_safety
Definition
Et bakdørsangrep involverer forgiftning av treningsdataene til en maskinlæringsmodell med spesifikke mønstre, kjent som utløsere. Mens modellen fungerer normalt på ren data, aktiverer den feilaktige atferd når utløseren…
Summary
En sikkerhetstrussel der onde aktører legger inn skjulte utløsere i AI-modeller under treningen for å forårsake spesifikke feilklassifiseringer.
Key Concepts
- Dataforgiftning
- Modellintegritet
- Fiendtlige maskinlæringsmetoder
- Utløsermønstre
Use Cases
- Sikkerhetstesting av ML-pipelines
- Utvikling av forsvarsmekanismer
- Revisjon av tredjepartsmodeller