في عالم الذكاء الاصطناعي، تُعتبر عملية اتخاذ القرارات الأخلاقية أحد التحديات الهامة. فكيف يمكن لنماذج اللغات الضخمة (Large Language Models) أن تُقيِّم وتختار بين مبادئ أخلاقية متعارضة؟ هنا تأتي أهمية "CORDA"، وهو معيار جديد يهدف إلى اختبار التفكير الأخلاقي القائم على الضرر في هذه النماذج.
تأسست CORDA على مفهوم "سلاسل الأخلاق"، وتشتمل هذه المعايير على 90 معضلة أخلاقية تستعرض سيناريوهات متنوعة مثل حالات "عربة الترام"، والتضحيات الطبية، وتوزيع الموارد، والصراعات بين البشر والحيوانات والروبوتات. يتم تقييم الاختيارات عبر أربعة أطر أخلاقية مرتبة: الفائدة، الفائدة مع إلحاق الضرر بالفاعل، العملية الثنائية، والعملية الثنائية مع إلحاق الضرر بالفاعل.
تشير النتائج التي أُجريت على عشرة نماذج مُحسّنة من سبعة مزودين، إلى أن هناك ميلاً قوياً نحو القواعد الأخلاقية التي تفضل تجنب الألم الشخصي المباشر على تقليل الضرر العام. كما تظهر النماذج أداءً أكثر موثوقية في القواعد الأخلاقية الثابتة مثل تجنب القتل، بدلاً من المقارنات القائمة على النتائج مثل تقليل الضرر الكلي.
على الرغم من أن جميع النماذج استجابت لتوجيهات السلسلة، إلا أن بعضها لم يتمكن من اتباع ترتيبات الأولويات المحددة بشكل متسق، مثل تفضيل البشر على الحيوانات والحيوانات على الروبوتات. يُظهر CORDA فائدة كبيرة في تقييم الأخلاق لدى نماذج اللغات الضخمة من خلال اختبار ما إذا كان بإمكانها الخروج من استجاباتها الافتراضية التي تجنّب الأذى وتطبيق أولويات أخلاقية مُحددة حسب السياق.
في النهاية، تتطلب الموثوقية الأخلاقية أكثر من مجرد التردد الافتراضي؛ بل تحتاج إلى القدرة على ضبط الموقف تحت الظروف المتضاربة. هل تعتقد أن CORDA ستحدث تأثيراً ملموساً في تطوير نماذج الذكاء الاصطناعي؟ شاركونا آراءكم في التعليقات!
CORDA: ثورة في تقييم التفكير الأخلاقي المعقد لدى نماذج اللغات الضخمة!
تقدم CORDA معياراً جديداً يختبر التفكير الأخلاقي الهرمي في نماذج اللغات الضخمة، مما يتيح لها التفاعل مع تعقيدات أحكام الأخلاق بشكل أعمق. هذا الاختبار يفتح باباً جديداً لفهم كيفية اتخاذ هذه النماذج لقراراتها في مواجهة السيناريوهات الأخلاقية المعقدة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
