Vastustava hyökkäys
term_id: adversarial_attack
Category: ethics_safety
Definition
Vastustavat hyökkäykset hyväksikäyttävät neuroverkkojen haavoittuvuutta lisäämällä syötteisiin, kuten kuviin tai tekstiin, hienovaraisia kohinaa, mikä aiheuttaa merkittäviä virheitä mallin tuloksissa. Nämä hyökkäykset korostavat…
Summary
Vastustavassa hyökkäyksessä syötedataan lisätään pieniä, usein havaitsemattomia häiriöitä, jotka harhaanjohtavat koneoppimismalleja tekemään virheellisiä ennusteita.
Key Concepts
- Häiriö
- Mallin robustius
- Valkoinen laatikko vs. musta laatikko
- Väistelyhyökkäykset
Use Cases
- Mallien turvallisuuden testaus
- Vastustavien esimerkkien generointi koulutusta varten
- Tietokonevision järjestelmien haavoittuvuuksien analysointi