Injection de Prompt
term_id: prompt_injection
Category: ethics_safety
Definition
L’injection de prompt exploite la manière dont les grands modèles de langage interprètent les instructions utilisateur en intégrant des directives cachées ou conflictuelles dans le texte d’entrée. Cela peut amener le modèle à ignorer ses instructions originales.
Summary
Une attaque adversariale où des entrées malveillantes manipulent un modèle d’IA pour contourner les filtres de sécurité ou exécuter des commandes non prévues.
Key Concepts
- Attaques Adversariales
- Prompts Système
- Risques de Sécurité
- Sanitisation des Entrées
Use Cases
- Tests de Sécurité des LLM
- Sécurité des Chatbots
- Protection de la Vie Privée des Données