프롬프트 인젝션

term_id: prompt_injection

Category: ethics_safety

Definition

프롬프트 인젝션은 대용량 언어 모델(LLM)이 사용자 지시를 해석하는 방식을 악용하여, 입력 텍스트 내에 숨겨지거나 상충되는 지시를 삽입합니다. 이로 인해 모델이 원래의 안전 지침을 무시하고 공격자의 의도에 따를 수 있습니다.

Summary

악의적인 입력을 통해 AI 모델이 안전 필터를 우회하거나 의도하지 않은 명령을 실행하도록 조작하는 적대적 공격.

Key Concepts

  • 적대적 공격
  • 시스템 프롬프트
  • 보안 위험
  • 입력 정제(Input Sanitization)

Use Cases

  • LLM 보안 테스트
  • 챗봇 안전성 강화
  • 데이터 프라이버시 보호