في إطار سعي الباحثين لفهم كيفية حماية نماذج الرؤية اللغوية تحت الأشعة تحت الحمراء (IR-VLMs) من الهجمات المستهدفة، ظهر مفهوم جديد يحمل اسم InfraPatch. هذه التقنية المبتكرة تسلط الضوء على كيفية استغلال نقاط الضعف في الأنظمة التي تعتمد على المعالجة متعددة الوسائط في بيئات ذات رؤى منخفضة.

تقنية InfraPatch تعد نظامًا هشّاً، يتمثل في إحداث هجمات باتش رقمية باللون الرمادي تستهدف نماذج IR-VLMs. تركّز هذه التقنية على تحسين عمليات الإخفاء في نطاق محلي ضيق، حيث يجري استخدام باتش وحيد القناة لا يتجاوز 5% من مساحة النموذج، مما يعزز قدرة الهجوم على التأثير على سلوكيات التصنيف والتعليق على الصور، بالإضافة إلى الأسئلة البصرية الثنائية.

عبر إجراء تقييم شامل على عشرة نماذج معدلة للأشعة تحت الحمراء باستخدام 300 صورة تم إنشاؤها بطريقة مخصصة، أثبتت نتائج InfraPatch نجاحًا استهدافيًا يتراوح بين 86.00% و100% على النماذج التي تم اختبارها.

تعتبر هذه النتائج بمثابة إشارة قوية لكيفية أهمية تقييم حماية الأنظمة متعددة الوسائط للحد من تأثير الهجمات الرقمية، مما يشير إلى ضرورة مواصلة التحقيق في قوة تطبيقات الرؤية الضوئية تحت الأشعة تحت الحمراء لتصبح أكثر أمانا.

فهل تتوقع أن تساهم هذه الابتكارات في تحسين أمان أنظمة الرؤية الضوئية؟ انضم إلى المحادثة وشاركنا آراءك!