Injection de Prompt

term_id: prompt_injection

Category: ethics_safety

Definition

L’injection de prompt exploite la manière dont les grands modèles de langage interprètent les instructions utilisateur en intégrant des directives cachées ou conflictuelles dans le texte d’entrée. Cela peut amener le modèle à ignorer ses instructions originales.

Summary

Une attaque adversariale où des entrées malveillantes manipulent un modèle d’IA pour contourner les filtres de sécurité ou exécuter des commandes non prévues.

Key Concepts

  • Attaques Adversariales
  • Prompts Système
  • Risques de Sécurité
  • Sanitisation des Entrées

Use Cases

  • Tests de Sécurité des LLM
  • Sécurité des Chatbots
  • Protection de la Vie Privée des Données