프롬프트 인젝션
term_id: prompt_injection
Category: ethics_safety
Definition
프롬프트 인젝션은 대용량 언어 모델(LLM)이 사용자 지시를 해석하는 방식을 악용하여, 입력 텍스트 내에 숨겨지거나 상충되는 지시를 삽입합니다. 이로 인해 모델이 원래의 안전 지침을 무시하고 공격자의 의도에 따를 수 있습니다.
Summary
악의적인 입력을 통해 AI 모델이 안전 필터를 우회하거나 의도하지 않은 명령을 실행하도록 조작하는 적대적 공격.
Key Concepts
- 적대적 공격
- 시스템 프롬프트
- 보안 위험
- 입력 정제(Input Sanitization)
Use Cases
- LLM 보안 테스트
- 챗봇 안전성 강화
- 데이터 프라이버시 보호