محاذاة الذكاء الاصطناعي
term_id: ai_alignment
Category: ethics_safety
Definition
تعالج محاذاة الذكاء الاصطناعي تحدي جعل أنظمة الذكاء الاصطناعي تقوم بشكل قوي بما ينوي مستخدموها، بدلاً من ما يحددونه حرفياً. تتضمن ذلك أساليب تقنية لضمان توافق السلوك مع التوقعات الإنسانية.
Summary
مجال دراسي يركز على ضمان سلوك أنظمة الذكاء الاصطناعي بما يتوافق مع القيم والنوايا البشرية.
Key Concepts
- تعلم القيم
- السلوك المفيد
- مشكلة التحكم
- القابلية للتفسير
Use Cases
- أبحاث السلامة في النماذج اللغوية الكبيرة
- تطوير دوال المكافآت لتعلم التعزيز من التغذية الراجعة البشرية (RLHF)
- تنفيذ المبادئ التوجيهية الأخلاقية