الضوابط الأمنية
term_id: guardrails
Category: application_paradigms
Definition
تشير الضوابط الأمنية إلى مجموعة من عناصر التحكم البرمجية وطبقات إنفاذ السياسات المدمجة في تطبيقات الذكاء الاصطناعي، ولا سيما النماذج اللغوية الكبيرة، لضمان سلوك آمن ومتوافق مع المعايير. تعمل هذه الضوابط كمرشحات تتحقق من المدخلات والمخرجات للتأكد من خلوها من المحتوى غير اللائق.
Summary
آليات أمان مصممة لتقييد مخرجات نماذج الذكاء الاصطناعي لمنع توليد محتوى ضار أو متحيز أو غير مصرح به.
Key Concepts
- تصفية المدخلات/المخرجات
- إنفاذ السياسات
- كشف السمية
- الدفاع ضد حقن الأوامر
Use Cases
- روبوتات الدردشة المؤسسية التي تتطلب امتثالاً صارماً للعلامة التجارية
- المساعدون الصحيون الذين يضمنون الدقة الطبية والخصوصية
- روبوتات خدمة العملاء التي تمنع استخدام لغة مسيئة