في عصر التكنولوجيا الحديثة، أصبحت نماذج اللغة الكبيرة (Large Language Models) جزءاً أساسياً من التطبيقات الذكية، مع تقديمها إمكانيات معالجة لغوية متطورة. ومع ذلك، تتضمن هذه الأنظمة ثغرات قد تتيح تسرب المعلومات. من أبرز هذه التقنيات الجديدة هي SparSEEty، التي تم تصميمها لاستخراج الرموز من الأنظمة المعتمدة على الكثافة النشطة.

تتمثل الفكرة الرئيسية وراء SparSEEty في استغلال الكثافة النشطة، حيث يتم تفعيل جزء فقط من الخلايا العصبية عند معالجة مدخلات معينة. في حين تمكنت الأبحاث السابقة من تحسين أنظمة تقديم الخدمة باستخدام هذه الخاصية عن طريق تجاهل الأوزان والحسابات الخاصة بالخلايا غير النشطة، إلا أن ذلك أسفر عن وصول بيانات معتمدة على المدخلات، مما قد يكشف معلومات حساسة عبر قنوات جانبية.

تقوم SparSEEty أولاً بإنشاء «أوراكل تنشيط الخلايا العصبية» (neuron-activation oracle) باستخدام بيانات الوصول إلى الأوزان العصبية يتم جمعها أثناء عملية الاستدلال، ثم تعكس آثار التنشيط لإعادة بناء الرموز المدخلة، مما يؤدي إلى هجوم استخراج رموز شامل.

تُظهر التقييمات أن SparSEEty يمكنها إعادة بناء الرموز المدخلة والاستجابات بدقة عالية، معدلةً باستمرار في درجات BLEU لتتجاوز 0.95، مع تكاليف متابعة تتراوح بين 3.7% و7.2%. يتم ذلك بينما تجري الحماية داخل بيئات افتراضية سرية بمساعدة تقنيات متميزة من Intel TDX.

في ختام الحديث، يبرز هذا البحث الحاجة الملحة لتعزيز الأمان في نماذج اللغة الكبيرة لضمان سلامة البيانات وخصوصيتها. فهل ستكون هذه الثغرات دليلاً على حاجة ماسة لتحسين نظم الأمان؟ شاركونا آراءكم في التعليقات!