تتواصل الأبحاث في مجالات الأخلاق الآلية (Machine Ethics) ومحاذاة القيم (Value Alignment) بشكل متزايد، حيث يركز العلماء على تصميم وكلاء اصطناعيين يتوافقون مع القيم الإنسانية ويعملون بطرق مقبولة أخلاقياً. في الآونة الأخيرة، برز الاعتماد على التعلم المعزز (Reinforcement Learning) كأداة رئيسية لتطوير هؤلاء الوكلاء، مما أدى إلى تهميش الأدبيات الفلسفية التي كانت تلعب دوراً مركزياً سابقاً. في ظل هذه الخلفية، تسعى هذه الورقة إلى تحقيق هدفين رئيسيين.

الهدف الأول هو استنباط أفكار من الأبحاث الحديثة في نظرية الميتانورماتيفية، والتي يمكن أن تكون مفيدة لتصميم وكلاء أخلاقيين ومتوافقين مع القيم. بينما الهدف الثاني هو فحص هندسة التعلم المعزز من خلال عدسة هذه الأفكار. من خلال تحليل السلوكيات للوكلاء المعتمدين على التعلم المعزز، يمكننا تقديم معايير أوضح لتصنيف تصرفات الوكيل كأخلاقية. بالإضافة إلى ذلك، سيوفر هذا الأساس معايير لتقييم ومقارنة الأساليب المختلفة المعتمدة على التعلم المعزز في مجالات الأخلاق الآلية ومحاذاة القيم.

في الختام، يتضح أن دمج هذه النظريات يمكن أن يسهم بشكل كبير في تصميم أنظمة ذكاء اصطناعي أكثر أماناً وأخلاقية. فهل ستصبح هذه الجهود القادمة الأساس لذكاء اصطناعي يراعي القيم الإنسانية؟