Prompt Injection
term_id: prompt_injection
Category: ethics_safety
Definition
Prompt injection udnytter den måde, store sprogmodeller fortolker brugerinstruktioner på, ved at indlejre skjulte eller modstridende direktiver i inputteksten. Dette kan få modellen til at ignorere dens oprindelige sikkerhedsinstrukser.
Summary
Et fjendtligt angreb, hvor ondsindede inputs manipulerer en AI-model til at omgå sikkerhedsfiltre eller udføre uønskede kommandoer.
Key Concepts
- Fjendtlige angreb
- Systemprompts
- Sikkerhedsrisici
- Input-sanitisering
Use Cases
- Sikkerhedstest af LLM’er
- Chatbot-sikkerhed
- Beskyttelse af dataprivacy