Ataque adversarial
term_id: adversarial_attack
Category: ethics_safety
Definition
Os ataques adversariais exploram as vulnerabilidades das redes neurais introduzindo ruído sutil nas entradas, como imagens ou texto, o que causa erros significativos na saída do modelo. Esses ataques destacam a fragilidade dos modelos diante de entradas manipuladas intencionalmente.
Summary
Uma técnica onde pequenas perturbações, muitas vezes imperceptíveis, são adicionadas aos dados de entrada para enganar modelos de aprendizado de máquina e fazer com que façam previsões incorretas.
Key Concepts
- Perturbação
- Robustez do modelo
- Caixa branca vs. Caixa preta
- Ataques de evasão
Use Cases
- Teste de segurança de modelos
- Geração de exemplos adversariais para treinamento
- Análise de vulnerabilidade em sistemas de visão computacional