Tiêm nhiễm Prompt

term_id: prompt_injection

Category: ethics_safety

Definition

Tiêm nhiễm prompt khai thác cách các mô hình ngôn ngữ lớn (LLM) diễn giải hướng dẫn của người dùng bằng cách nhúng các chỉ thị ẩn hoặc mâu thuẫn vào văn bản đầu vào. Điều này có thể khiến mô hình bỏ qua các hướng dẫn ban đầu của hệ thống.

Summary

Một cuộc tấn công đối kháng, trong đó các đầu vào độc hại thao túng mô hình AI để vượt qua bộ lọc an toàn hoặc thực thi các lệnh không mong muốn.

Key Concepts

  • Tấn công đối kháng
  • Prompt hệ thống
  • Rủi ro bảo mật
  • Thanh lọc đầu vào

Use Cases

  • Kiểm tra bảo mật LLM
  • An toàn Chatbot
  • Bảo vệ quyền riêng tư dữ liệu