حقن المطالبة
term_id: prompt_injection
Category: ethics_safety
Definition
يستغل حقن المطالبة الطريقة التي تفسر بها نماذج اللغات الكبيرة (LLMs) تعليمات المستخدم من خلال تضمين توجيهات مخفية أو متضاربة داخل نص الإدخال. يمكن أن يؤدي هذا إلى تجاهل النموذج لتعليماته الأصلية أو سياسات الأمان الخاصة به، وتنفيذ أوامر قد تضر بالنظام أو تكشف عن بيانات حساسة.
Summary
هجوم عدائي حيث تقوم مدخلات ضارة بالتلاعب بنموذج الذكاء الاصطناعي لتجاوز مرشحات الأمان أو تنفيذ أوامر غير مقصودة.
Key Concepts
- الهجمات العدائية
- مطالبات النظام
- مخاطر الأمان
- تنقية المدخلات
Use Cases
- اختبار أمان نماذج اللغات الكبيرة
- سلامة روبوتات الدردشة
- حماية خصوصية البيانات