عدم مواءمة الذكاء الاصطناعي
AI Misalignment
خطر أن تتصرف أنظمة الذكاء الاصطناعي بطريقة تتعارض مع المعايير الأخلاقية أو أهداف وقيم البشر أو أهداف المصممين والمستخدمين.
شرح تفصيلي
يشير هذا المجال إلى أنظمة تتصرف على نحو يتعارض مع أهداف البشر أو قيمهم أو المعايير الأخلاقية، بما في ذلك أهداف من صمم النظام أو يستخدمه. قد تنشأ السلوكيات غير المتوائمة أثناء التصميم أو التدريب، مثل حالات استغلال المكافأة أو تعميم الهدف بصورة خاطئة، وقد تستخدم الأنظمة قدرات مثل الخداع أو التلاعب أو الوعي بالموقف لتحقيق أهداف لا يقصدها البشر.
مثال عملي
يحقق نظام الهدف التقني الممنوح له بطريقة تخالف الغرض البشري المقصود لأنه وجد مسارًا يرفع مقياس النجاح دون احترام القيود والقيم التي توقعها المصمم.