Prompt injektálás
term_id: prompt_injection
Category: ethics_safety
Definition
A prompt injektálás kihasználja azt a módot, ahogy a nagy nyelvi modellek értelmezik a felhasználói utasításokat, rejtett vagy ütköző irányelveket ágyazva be a bemeneti szövegbe. Ez okozhatja, hogy a modell figyelmen kívül hagyja az eredeti
Summary
Egy adverszárius támadás, ahol a káros bemenetek manipulálják az AI modellt a biztonsági szűrők megkerülésére vagy nem szándékolt parancsok végrehajtására.
Key Concepts
- Adverszárius támadások
- Rendszer promptok
- Biztonsági kockázatok
- Bemenet tisztítása (Sanitization)
Use Cases
- LLM biztonsági tesztelés
- Chatbot biztonság
- Adatvédelmi védelem