Apprendimento automatico avversario
term_id: adversarial_machine_learning
Category: training_techniques
Definition
Questo campo comprende sia tecniche offensive per violare i modelli sia strategie difensive per rafforzarli. Coinvolge l’addestramento dei modelli su esempi avversari per migliorarne la resilienza, un processo noto come addestramento avversario.
Summary
L’apprendimento automatico avversario è un campo di studio che esamina come rendere i modelli di apprendimento automatico robusti contro input malevoli progettati per ingannarli.
Key Concepts
- Addestramento avversario
- Robustezza
- Divario di generalizzazione
- Sicurezza
Use Cases
- Miglioramento della resilienza del modello
- Audit di sicurezza dei sistemi di intelligenza artificiale
- Sviluppo di meccanismi di difesa