Injeksi Prompt

term_id: prompt_injection

Category: ethics_safety

Definition

Injeksi prompt memanfaatkan cara model bahasa besar menafsirkan instruksi pengguna dengan menanamkan direktif tersembunyi atau bertentangan di dalam teks input. Hal ini dapat menyebabkan model mengabaikan instruksi asli atau kebijakan keselamatannya.

Summary

Serangan adversarial di mana input jahat memanipulasi model AI untuk melewati filter keamanan atau mengeksekusi perintah yang tidak disengaja.

Key Concepts

  • Serangan Adversarial
  • Prompt Sistem
  • Risiko Keamanan
  • Sanitasi Input

Use Cases

  • Pengujian Keamanan LLM
  • Keamanan Chatbot
  • Perlindungan Privasi Data