في عالم الذكاء الاصطناعي، تشهد نماذج اللغة الكبيرة (Large Language Models) تطورًا سريعًا، لكن هذا التطور يرافقه أيضًا تحديات جديدة تتعلق بالأمان. قدمت تقنية جديدة تُعرف باسم "لواراسكان" (LoRAScan)، وهي الأداة الأولى من نوعها التي تهدف إلى اكتشاف المدخلات الخبيثة إلى النماذج اللغوية التي تستخدم محولات منخفضة الرتبة (Low-Rank Adapters).
تتيح تقنية التكيف منخفض الرتبة (Low-Rank Adaptation) تخصيص وتوزيع نماذج اللغة الكبيرة بشكل فعال، لكن استخدام محولات غير موثوقة يمكن أن يتسبب في تهديدات خطيرة وسلسلة التوريد. بفضل "لواراسكان"، يمكن للنماذج اكتشاف المدخلات التي تحتوي على مشغلات خفية تتسبب في توليد محتوى ضار أو تعليمات خبيثة، دون الحاجة لتعديل معلمات المحول.
تستند هذه التقنية إلى ملاحظة أن نسبة صغيرة من مواقع إدخال "لوارا" (LoRA) تبقى مستقرة عبر المدخلات النظيفة بينما تظهر spikes (طفرات) مركزة جدًا في نشاطاتها عندما يتواجد المشغل. من خلال مراقبة هذه المواقع، تستطيع لواراسكان رفض المدخلات الضارة بدقة بنسبة 98.49% وبخطأ صغير على المدخلات النقية، متفوقة بذلك على الدفاعات السابقة.
إن "لواراسكان" ليست مجرد خطوة نحو تحسين الأمان، بل تمثل قفزة نوعية في كيفية تعاملنا مع التهديدات في مجال الذكاء الاصطناعي.
لواراسكان: اكتشاف تهديدات الباكدور في نماذج اللغة الكبيرة بذكاء وأمان
تقدم لواراسكان تقنية مبتكرة لاكتشاف التهديدات الخبيثة في محولات النماذج اللغوية الكبيرة، مما يضمن أمانًا أكبر في استخدام هذه التكنولوجيا. هذه الحلول تعزز الأمان ضد البرامج الخبيثة التي قد تتسلل عبر المدخلات المخفية.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
