في عصر التكنولوجيا الحديثة، أصبحت نماذج اللغة الكبيرة (Large Language Models) جزءاً أساسياً من التطبيقات الذكية، مع تقديمها إمكانيات معالجة لغوية متطورة. ومع ذلك، تتضمن هذه الأنظمة ثغرات قد تتيح تسرب المعلومات. من أبرز هذه التقنيات الجديدة هي SparSEEty، التي تم تصميمها لاستخراج الرموز من الأنظمة المعتمدة على الكثافة النشطة.
تتمثل الفكرة الرئيسية وراء SparSEEty في استغلال الكثافة النشطة، حيث يتم تفعيل جزء فقط من الخلايا العصبية عند معالجة مدخلات معينة. في حين تمكنت الأبحاث السابقة من تحسين أنظمة تقديم الخدمة باستخدام هذه الخاصية عن طريق تجاهل الأوزان والحسابات الخاصة بالخلايا غير النشطة، إلا أن ذلك أسفر عن وصول بيانات معتمدة على المدخلات، مما قد يكشف معلومات حساسة عبر قنوات جانبية.
تقوم SparSEEty أولاً بإنشاء «أوراكل تنشيط الخلايا العصبية» (neuron-activation oracle) باستخدام بيانات الوصول إلى الأوزان العصبية يتم جمعها أثناء عملية الاستدلال، ثم تعكس آثار التنشيط لإعادة بناء الرموز المدخلة، مما يؤدي إلى هجوم استخراج رموز شامل.
تُظهر التقييمات أن SparSEEty يمكنها إعادة بناء الرموز المدخلة والاستجابات بدقة عالية، معدلةً باستمرار في درجات BLEU لتتجاوز 0.95، مع تكاليف متابعة تتراوح بين 3.7% و7.2%. يتم ذلك بينما تجري الحماية داخل بيئات افتراضية سرية بمساعدة تقنيات متميزة من Intel TDX.
في ختام الحديث، يبرز هذا البحث الحاجة الملحة لتعزيز الأمان في نماذج اللغة الكبيرة لضمان سلامة البيانات وخصوصيتها. فهل ستكون هذه الثغرات دليلاً على حاجة ماسة لتحسين نظم الأمان؟ شاركونا آراءكم في التعليقات!
SparSEEty: ثغرة جديدة تكشف النقاب عن بيانات نماذج اللغة الكبيرة باستخدام قنوات جانبية متطورة!
تقدم دراسة جديدة تقنية SparSEEty التي تستغل خصائص نماذج اللغة الكبيرة لاستخراج الرموز من الأنظمة التي تعتمد على الكثافة النشطة. تكشف هذه التقنية عن تحديات أمنية جديدة قد تؤثر على خصوصية البيانات.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
