ظهر الذكاء الاصطناعي ليشغل موقعاً مركزياً في حياتنا اليومية، وأصبحت نماذج الرؤية واللغة (Vision-Language Models - VLM) جزءًا لا يتجزأ من ذلك. ومع ظهور تقنيات جديدة، أتت تحديات أمنية تثير القلق. في الآونة الأخيرة، كشف بحث علمي مدى قوة هذه النماذج في مواجهة هجمات الصور المقطعة، ومن هنا بدأ النقاش حول فعالية هذه الأنظمة أمام الهجمات المختلفة.
أثبتت الأبحاث أنه بالرغم من التحسينات الكبيرة التي شهدتها نماذج VLM في أمانها، فإن هناك ثغرات جديدة قد تم التعرض لها. تم تطوير هجمات جديدة تعرف بـ"هجمات كسر الصورة البصرية" (SIVA) والتي تستهدف هذه الثغرات، حيث تتعرض هذه النماذج للصعوبة في اكتشاف المدخلات الضارة التي تشتمل على مكونات موزعة عبر عدة صور.
تتضح المشكلة في أنها تعتمد عادةً على تكييف الأمان مع الصور الكاملة فقط، مما يؤدي إلى عدم قدرتها على التعرف على الإشارات الضارة عندما يتم تجميع الصور. تقدم هذه الدراسة استراتيجيات جديدة تتيح استغلال هذه الفجوة.
ومن خلال الأبحاث، تبين أن تطوير خوارزمية جديدة تُعرف بـ"التحصيل المعرفي العدائي" (Adversarial Knowledge Distillation) قد أدى إلى تحسين ملحوظ في إمكانية نقل الهجمات بين النماذج، حيث أظهرت النتائج زيادة تصل إلى 44% في نسبة النجاح عند الهجمات.
في ظل هذا التقدم، صار ضرورياً النظر في استراتيجيات فعالة لتعزيز أمان نماذج VLM في مواجهة هذه التهديدات المتزايدة.
هجوم مبتكر على نماذج الرؤية واللغة: فهم نقاط الضعف الجديدة!
يكشف بحث حديث عن نقاط ضعف خطيرة في نماذج الرؤية واللغة (VLM) تؤثر على أمانها ضد هجمات الصور المقطعة. ويقدم استراتيجيات جديدة للتغلب على هذه الثغرات بكفاءة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
