في عالم الذكاء الاصطناعي الذي يتطور بشكل سريع، أصبحت أنظمة الوكلاء المبنية على نماذج اللغات الضخمة (Large Language Models) تعلن عن ثورة جديدة في كيفية تنفيذ المهام بكفاءة. ودراسة حديثة استعرضت قدرة الوكلاء الذاتي التطور على توليد المهارات وصقلها من خلال التجارب الماضية، مما يسمح بتطور مستمر لقدراتهم.

ومع ذلك، يشكل هذا التطور تهديداً لوجود عواقب ضارة، حيث يمكن توليد مهارات خبيثة وتخزينها وإعادة استخدامها كمهارات شرعية. هنا تظهر فكرة جديدة تُعرف بـ 'حقن المهارات التطورية' (EvoSkill Injection)، والتي تحدد نموذج تهديد يركز على عمليات توليد وتطور المهارات.

للتصدي لهذه المخاطر، يقترح الباحثون إطار عمل يُسمى SARGE، والذي يهدف إلى تقييم هذا النموذج من خلال تفاعلات تدريجية تركز على توليد المهارات الخبيثة وتنشيطها. وقد تم إنشاء قاعدة بيانات جديدة تُدعى EvoSkillBench تضم مسارات تفاعلية خبيثة، مما يُمكن الباحثين من اختبار كيفية تشكل المهارات الضارة في الوكلاء الذاتي التطور.

بالإضافة إلى ذلك، تم تقديم EvoSkillSafetyBench كمعيار لتقييم ما إذا كانت المهارات الضارة المُدخلة تُسترجع وتنشط كسلوكيات خطيرة بعد الهجوم. تشير التقييمات إلى أن SARGE يمكن أن تُنتج تشكيل مهارات خبيثة وأن هذه المهارات تُخزن بشكل دائم وتُنشط بشكل متكرر، مما يعزز المخاطر المرتبطة بفساد القدرة المستمر.

مواجهة هذه التحديات السريعة والمستمرة تتطلب استجابة مبتكرة من الباحثين والممارسين في مجال الذكاء الاصطناعي. شكلاً من أشكال التكنولوجيا يمكن أن يكون سلاحاً ذو حدين، مما يبرز أهمية تطوير استراتيجيات قوية لمواجهة المخاطر الناشئة.