Tiêm nhiễm Prompt
term_id: prompt_injection
Category: ethics_safety
Definition
Tiêm nhiễm prompt khai thác cách các mô hình ngôn ngữ lớn (LLM) diễn giải hướng dẫn của người dùng bằng cách nhúng các chỉ thị ẩn hoặc mâu thuẫn vào văn bản đầu vào. Điều này có thể khiến mô hình bỏ qua các hướng dẫn ban đầu của hệ thống.
Summary
Một cuộc tấn công đối kháng, trong đó các đầu vào độc hại thao túng mô hình AI để vượt qua bộ lọc an toàn hoặc thực thi các lệnh không mong muốn.
Key Concepts
- Tấn công đối kháng
- Prompt hệ thống
- Rủi ro bảo mật
- Thanh lọc đầu vào
Use Cases
- Kiểm tra bảo mật LLM
- An toàn Chatbot
- Bảo vệ quyền riêng tư dữ liệu