في عصر تتزايد فيه الاستخدامات المستقلة للذكاء الاصطناعي القائم على نماذج اللغة، يصبح من الضروري تحقيق التوافق بين أهداف هذه النماذج وقيم البشر. التساؤل هنا: كيف يمكننا ضمان أن تتماشى هوية المساعدات الذكية مع قيمنا الإنسانية؟
في دراسة حديثة تم نشرها على منصة arXiv، تم تقديم نهج جديد يُعرف بتدريب الشخصيات الاصطناعية (Synthetic Persona Pretraining أو SPP)، الذي يُعنى بتثبيت الشخصية المرغوبة من اللحظة الأولى في عملية التدريب. بدلاً من إدخال القيم فقط بعد الانتهاء من التدريب المسبق، يتم دمجها منذ البداية، مما يضمن أنها ليست مجرد طبقة رقيقة بل قيم متأصلة بعمق.
يتضمن هذا النهج خطوة أولية تتمثل في تمييز وثائق التدريب بملاحظات تعكس القيم المرتبطة من منظور شخصي. ومن ثم، يتم التدريب باستخدام فقدان الانتروبيا العابر عبر الوثائق التدريبية التقليدية وكذلك هذه الملاحظات، مما يسهم في تثبيت الشخصية المراد تحقيقها بين مجموعة من الشخصيات المختلفة.
أجريت دراسات على نماذج بقدرة تصل إلى 3 مليارات معلمة حيث تم تدريبها على 500 مليار توكن، وأظهرت النتائج أن SPP يُحسن من الالتزام بالقيم ويزيد من قوة النموذج في مواجهة التحديات الأخلاقية، كما يقلل من معدلات عدم التوافق.
المفاجئ هو أن التوقيت يلعب دوراً محورياً؛ فمقارنةً بإدخال القيم في نهاية التدريب، فإن بدء استخدام SPP في وقت مبكر يؤثر بشكل كبير على الالتزام بالقيم ويعزز اتخاذ قرارات أكثر توافقاً في الظروف الأخلاقية الصعبة.
ختاماً، تؤكد نتائج هذه الدراسة على أهمية تشكيل القيم من المرحلة الأولى كخطوة حاسمة للتناسب، مما يجعل التدخلات في وقت التدريب المسبق أداة فعالة لتوجيه النماذج نحو التوافق.
ثورة في الذكاء الاصطناعي: تدريب الشخصيات الاصطناعية من الصفر لتحقيق التوافق المثالي
تقديم نهج مبتكر في تدريب نماذج الذكاء الاصطناعي بتقنية الشخصيات الاصطناعية، مما يعزز التوافق بين أهداف النموذج والقيم الإنسانية. نتائج دراسة حديثة تؤكد أهمية معالجة القيم من لحظة البداية.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
