Prompt injektálás

term_id: prompt_injection

Category: ethics_safety

Definition

A prompt injektálás kihasználja azt a módot, ahogy a nagy nyelvi modellek értelmezik a felhasználói utasításokat, rejtett vagy ütköző irányelveket ágyazva be a bemeneti szövegbe. Ez okozhatja, hogy a modell figyelmen kívül hagyja az eredeti

Summary

Egy adverszárius támadás, ahol a káros bemenetek manipulálják az AI modellt a biztonsági szűrők megkerülésére vagy nem szándékolt parancsok végrehajtására.

Key Concepts

  • Adverszárius támadások
  • Rendszer promptok
  • Biztonsági kockázatok
  • Bemenet tisztítása (Sanitization)

Use Cases

  • LLM biztonsági tesztelés
  • Chatbot biztonság
  • Adatvédelmi védelem