حقن المطالبة

term_id: prompt_injection

Category: ethics_safety

Definition

يستغل حقن المطالبة الطريقة التي تفسر بها نماذج اللغات الكبيرة (LLMs) تعليمات المستخدم من خلال تضمين توجيهات مخفية أو متضاربة داخل نص الإدخال. يمكن أن يؤدي هذا إلى تجاهل النموذج لتعليماته الأصلية أو سياسات الأمان الخاصة به، وتنفيذ أوامر قد تضر بالنظام أو تكشف عن بيانات حساسة.

Summary

هجوم عدائي حيث تقوم مدخلات ضارة بالتلاعب بنموذج الذكاء الاصطناعي لتجاوز مرشحات الأمان أو تنفيذ أوامر غير مقصودة.

Key Concepts

  • الهجمات العدائية
  • مطالبات النظام
  • مخاطر الأمان
  • تنقية المدخلات

Use Cases

  • اختبار أمان نماذج اللغات الكبيرة
  • سلامة روبوتات الدردشة
  • حماية خصوصية البيانات