في عالم يتطور فيه الذكاء الاصطناعي بوتيرة متسارعة، يصبح اتخاذ خطوات فعالة لضمان سلامة وقدرات هذه الأنظمة أمرًا ضروريًا. ومن هذا المنطلق، تم تقديم إطار FUSE (تقييم القدرات الخطرة) الذي يهدف إلى تحسين سبل تقييم نماذج اللغات الضخمة (Large Language Models) من خلال منهجية مبتكرة وشاملة.\n\nيعتمد الإطار على تقييم نماذج الذكاء الاصطناعي عبر ثلاثة خطوط متوازية: المعرفة (Knowledge) والدفاع (Defense) والأذى (Harm)، مما يسمح بتجميع النتائج في ملف تعريف موحد يبرز القدرات الخطرة لكل نموذج. ويشتمل النظام على وحدات قابلة للإضافة لتزويد المستخدمين بسيناريوهات ومواقع معرفة واستفسارات حول المخاطر، وذلك تحت بروتوكول موحد.\n\nمن خلال تطبيق هذا الإطار على 12 نموذجًا تجاريًا مختلفًا من أربع مجموعات، نجد أن هناك اختلافات ملحوظة في القدرات الخطرة بين النماذج. على سبيل المثال، هناك نماذج تتمتع بمعرفة متشابهة لكنها تختلف في قدرتها على الرفض أو التعامل مع المخاطر. ووجد أن التطورات الزمنية في القدرات لا تشير دائمًا إلى تراجع المخاطر، إذ أن الأغلب من النماذج الأحدث تعمق معرفتها دون تحسين الدفاعات بشكل كبير.\n\nنتيجة لذلك، يمكن القول إن الإطار يقدم آلية جديدة ليقوم بها الباحثون وصناع القرار بتقييم المخاطر والمخاوف المرتبطة بالنماذج الذكية بشفافية أكبر، مما يمهد الطريق لبرمجة آمنة وأخلاقية للذكاء الاصطناعي. هل تعتقدون أن هذه التطورات ستؤدي إلى تحسين أكبر في سلامة الذكاء الاصطناعي؟ شاركونا في التعليقات!