Ataque adversarial

term_id: adversarial_attack

Category: ethics_safety

Definition

Os ataques adversariais exploram as vulnerabilidades das redes neurais introduzindo ruído sutil nas entradas, como imagens ou texto, o que causa erros significativos na saída do modelo. Esses ataques destacam a fragilidade dos modelos diante de entradas manipuladas intencionalmente.

Summary

Uma técnica onde pequenas perturbações, muitas vezes imperceptíveis, são adicionadas aos dados de entrada para enganar modelos de aprendizado de máquina e fazer com que façam previsões incorretas.

Key Concepts

  • Perturbação
  • Robustez do modelo
  • Caixa branca vs. Caixa preta
  • Ataques de evasão

Use Cases

  • Teste de segurança de modelos
  • Geração de exemplos adversariais para treinamento
  • Análise de vulnerabilidade em sistemas de visão computacional