Injeção de Prompt
term_id: prompt_injection
Category: ethics_safety
Definition
A injeção de prompt explora a forma como os grandes modelos de linguagem interpretam as instruções do usuário, incorporando diretivas ocultas ou conflitantes no texto de entrada. Isso pode fazer com que o modelo ignore suas instruções originais
Summary
Um ataque adversarial em que entradas maliciosas manipulam um modelo de IA para contornar filtros de segurança ou executar comandos não intencionais.
Key Concepts
- Ataques Adversariais
- Prompts do Sistema
- Riscos de Segurança
- Sanitização de Entrada
Use Cases
- Testes de Segurança de LLMs
- Segurança de Chatbots
- Proteção de Privacidade de Dados