تتطور نماذج اللغة الضخمة (Large Language Models) بسرعة لتصبح جزءًا أساسيًا من البنية التحتية التقنية الحديثة، حيث تعمل في بيئات البرمجة من خلال ما يُعرف بـ "الأدوات البرمجية" التي تراقب مستودعات الكود، وتستدعي الأدوات، وتعدل الملفات. وأي تغيير في الـ LLM المستخدم يمكن أن يؤثر بشكل كبير على قرارات الأمان، بما في ذلك مسألة التحقق من التعديلات واستعادة النظام بعد حدوث فشل.

تقنيات تحديد الهوية التقليدية لنماذج اللغة الضخمة غالبًا ما تستند إلى تحليلات توزيع النصوص أو الرموز. لكن عندما نتحدث عن البيئة البرمجية، تُعرقل هذه الإشارات عن طريق تعليمات النظام، المنطق المسيطر، الأدوات، والاستجابة للتنفيذ، مما يقلل من فاعلية التحليل.

في هذا السياق، أُدخلت تقنية LIDAR (تحديد هوية LLM من خلال القرارات والأفعال أثناء التشغيل) كطريقة نشطة لتحديد الهوية في بيئات شفافة. تتيح هذه التقنية الجديدة لمطوري البرمجيات التعرف على الهوية الحقيقية للـ LLMs من خلال سلوكها أثناء التنفيذ.

قام الباحثون باختبار ثلاث مجموعات من أدوات البرمجة لتسليط الضوء على جوانب مختلفة، مثل التحقق بعد التحرير واستعادة البيانات بعد الفشل، ومن خلال التعديلات المس控ّرة. تمثل LIDAR بشكل فعّال المسارات الناتجة باستخدام ميزات على مستوى الحالة وميزات على مستوى التوزيع، وتقارنها مع مراجع نظيفة بواسطة معرف احتمالي خفيف الوزن.

ملفت للنظر أن LIDAR تتطلب عدم الوصول إلى أوزان النماذج أو المعلومات الداخلية لمقدمي الخدمة. عبر 36 نموذجًا من سبع عائلات ونموذجي أدوات، حققت LIDAR دقة عالية ونتائج مُرضية تجاوزت أربع تقنيات سابقة لتحديد الهوية وتحليل واجهات برمجة التطبيقات.

تشير هذه النتائج إلى أن سلوك تنفيذ الوكلاء يوفر أدلة على هوية النموذج تتجاوز النتائج النهائية، مما يعكس أهمية البحث في كيفية تحسين أمان الأنظمة الذكية.

ما رأيكم في هذه التقنية؟ هل تعتقدون أنها ستحدث تحولًا كبيرًا في مجال أمان الذكاء الاصطناعي؟ شاركونا آرائكم في التعليقات.