في عالم الذكاء الاصطناعي، تزداد أهمية النماذج اللغوية طويلة الأمد (Long-Horizon LLM) مع تزايد استخدامها في مجالات متعددة. ومع ذلك، تسلط دراسة جديدة الضوء على مشكلات الأمن المرتبطة بها، حيث يتم التعامل مع محتوى غير موثوق به وذاكرة دائمة وأدوات حساسة.

تقليديًا، يتم تقييم الأمن من خلال عدد الخطوات التنفيذية بين الإدخال الضار والفعل الناجم عنه. تشير النتائج إلى أن الفواصل الزمنية تستطيع أن تبالغ في تقدير الفصل الأمني بين وكلاء في حالة وجود حالة معينة، مما يتطلب فحصًا أدق.

تم تقديم مفهوم جديد يُعرف بـ "مسافة التأثير" (Influence Distance)، الذي يُظهر العلاقة بين الأحداث التي ينفذها الوكلاء من خلال تواجد حالة مُحددة وأرقام هوية ومصدر أدوات.

عبر تحليل 454 زوجًا من التحولات الضارة، أفادت الدراسة أن 96.9% من الأزواج تُظهر فجوة بين "مسافة التأثير" و"المسافة التسلسلية"، مما يوحي بأن هناك حاجة للتدقيق أكثر في كيفية تقييم الفجوات الأمنية. حتى أن النتائج أظهرت بأن تحليل الهيكلية يمكن أن يؤدي إلى دعم التدخلات المستهدفة في الوقت الحقيقي.

من خلال انطلاق هذا البحث، يظهر أهمية تطوير أدوات أكثر فعالية في حماية وكلاء النماذج اللغوية والاستفادة منها في قدرات الأمن السيبراني بشكل عام.