مع الزيادة المستمرة في استخدام الذكاء الاصطناعي (AI) على الأجهزة المحمولة ومنتجات IoT، تتزايد الحاجة إلى تعزيز الخصوصية والاستجابة الفورية. لكن، تواجه نماذج اللغة وضغوطها المتزايدة أثناء التدريب في بيئات غير موثوقة أو متباينة، مما يجعلهن عرضة للتلاعب.

في دراسة جديدة، تم تقديم مفهوم "تعدد النماذج" (Model Multiplicity) كوسيلة مبتكرة لتعزيز أمن تدريب نماذج اللغة الصغيرة. بدلاً من الاعتماد على نموذج عالمي واحد، يتم تدريب عدة نماذج صغيرة مثل DistilGPT-2 بشكل متزامن، مما يجعلهن متباعدات في مسارات التدريب الخاصة بهن.

تُعد هذه الاستراتيجية مفيدة للغاية، حيث تتمكن من الكشف عن تهديدات التسميم من خلال قياس التباين بين نتائج نماذج متعددة، مما يوفر إشارات مبكرة عن سلوك غير طبيعي. في حال انحرف أحد النماذج بشكل كبير عن باقي المجموعة، يتم عزل العقد المساهمة في هذا النموذج.

تمت تجربة هذه الإطار الجديد في بيئات محاكية للأجهزة المحمولة تحت ظروف متباينة من الهجمات، وأظهرت النتائج أن تعددية النماذج تتيح الكشف عن التهديدات بشكل أسرع وأكثر موثوقية مقارنةً بالأساليب التقليدية. هذه النتائج تسلط الضوء على أهمية التنوع في نماذج الذكاء الاصطناعي كآلية عملية وفعالة في تعزيز الأمان في بيئات التعلم الموزعة على الأجهزة ذات الموارد المحدودة.

ما رأيكم في هذا التطور؟ هل تعتقدون أن تعددية النماذج يمكن أن تحدث فارقًا حقيقيًا في أمن الذكاء الاصطناعي؟ شاركونا في التعليقات!