Injeção de Prompt

term_id: prompt_injection

Category: ethics_safety

Definition

A injeção de prompt explora a forma como os grandes modelos de linguagem interpretam as instruções do usuário, incorporando diretivas ocultas ou conflitantes no texto de entrada. Isso pode fazer com que o modelo ignore suas instruções originais

Summary

Um ataque adversarial em que entradas maliciosas manipulam um modelo de IA para contornar filtros de segurança ou executar comandos não intencionais.

Key Concepts

  • Ataques Adversariais
  • Prompts do Sistema
  • Riscos de Segurança
  • Sanitização de Entrada

Use Cases

  • Testes de Segurança de LLMs
  • Segurança de Chatbots
  • Proteção de Privacidade de Dados