Adversarial maskinlæring
term_id: adversarial_machine_learning
Category: training_techniques
Definition
Dette felt omfatter både offensive teknikker til at bryde modeller og defensive strategier til at styrke dem. Det involverer at træne modeller på adversariale eksempler for at forbedre deres modstandsdygtighed, en proces kendt som adversarial træning.
Summary
Adversarial maskinlæring er et forskningsfelt, der studerer, hvordan man gør maskinlæringsmodeller robuste over for ondsindede inputs, der er designet til at narre dem.
Key Concepts
- Adversarial træning
- Robusthed
- Generaliseringsgab
- Sikkerhed
Use Cases
- Forbedring af modellens modstandsdygtighed
- Sikkerhedsrevision af AI-systemer
- Udvikling af forsvarsmekanismer