Prompt Injection

term_id: prompt_injection

Category: ethics_safety

Definition

Prompt injection udnytter den måde, store sprogmodeller fortolker brugerinstruktioner på, ved at indlejre skjulte eller modstridende direktiver i inputteksten. Dette kan få modellen til at ignorere dens oprindelige sikkerhedsinstrukser.

Summary

Et fjendtligt angreb, hvor ondsindede inputs manipulerer en AI-model til at omgå sikkerhedsfiltre eller udføre uønskede kommandoer.

Key Concepts

  • Fjendtlige angreb
  • Systemprompts
  • Sikkerhedsrisici
  • Input-sanitisering

Use Cases

  • Sikkerhedstest af LLM’er
  • Chatbot-sikkerhed
  • Beskyttelse af dataprivacy