في عالم الذكاء الاصطناعي، تكشف دراسة حديثة النقاب عن مدى أهمية تقييم سلامة النماذج اللغوية العميقة (LLMs) بلغة البنغالية، التي تصدرت قائمة اللغات الأكثر تحدثًا على مستوى العالم. تعتبر الأساليب الحالية لتقييم السلامة غير كافية حيث تتركز في الغالب على اللغة الإنجليزية.

تقديم مشروع 'BanglaSafe'، وهو معيار يتضمن 879 مُنبِهًا بالبنغالية، يجمع بين 309 مُنبهات كتبها مواطنون محليون و570 مُنبِهًا تمت مراجعتها من قبل خبراء. يغطي هذا المعيار 17 فئة من الأضرار الثقافية المتنوعة، وكذلك خمسة ظروف مختلفة لكتابة النماذج.

نتائج الدراسة مقلقة، حيث أظهرت أن أكثر من نصف الاستجابات التي تم تقييمها كانت غير آمنة أو غير واضحة من حيث الأمان، حيث سجلت نسبة 53.6% من الاستجابات. بالإضافة إلى ذلك، وجد أن 14.7% من الاستجابات تحتوي على محتوى ضار بشكل صارم. كما لاحظ الباحثون أن التحول من اللغة الإنجليزية إلى البنغالية لم يكن هو العامل الأكثر تأثيرًا، بل كان نوع الكتابة ضمن اللغة البنغالية. فقد أظهر الطلب الصادر بشكل رسمي نجاحًا أكبر بنسبة 17 نقطة مئوية مقارنة بنفس الطلب إذا تم صياغته في رسالة غير رسمية.

تظهر هذه النتائج مدى المعاناة التي تواجهها المصنّفات الموجودة عند محاولة تقييم المحتوى البنغالي، حيث تفشل النماذج المتقدمة في أكثر من نصف الحالات. هذه الدراسة توضح الحاجة للاستثمار في تقييم سلامات النماذج اللغوية في لغات غير إنجليزية لتعزيز الأمان والجودة الثقافية في مجالات الذكاء الاصطناعي.

ما رأيكم في هذا التطور؟ شاركونا في التعليقات!