في عالم الذكاء الاصطناعي، يظهر مفهوم "التعلم الخفي" (Subliminal Learning) كظاهرة مثيرة للاهتمام، حيث يُمكن لبيانات التقطير أن تنقل سمات من نموذج المعلم دون أن تكون مرئية بوضوح في مجموعة البيانات نفسها. هذا الأمر يطرح تحديات جديدة في تطوير النماذج، فضلاً عن مخاطر من تسميم البيانات.

في بحثنا الجديد، نستعرض كيف يمكن استخدام تقنيات تحسين النصوص (Text Optimization) للكشف عن تأثيرات التعلم الخفي، مع تقديمها كمطالب واضحة. العوامل الموجهة من نموذج المعلم تلهم منهجيتنا، حيث نعتبر أن هذه الحالة تمثل نوعًا خاصًا من تقطير السياق (Context Distillation).

نقوم بتقليل مشكلة استعادة المطالب إلى مشكلة تحسين نصوص، ونتبنى طريقة تُدعى SALVE (Search-Aided Latent Verbalization). تعمل SALVE على تحسين الطلبات الناعمة (Soft Prompt)، وتستعرض نفس النموذج لتظهرها كنص، وتستخدم البحث الشامل لجعل النص الناتج موثوقًا. في الإعدادات التقليدية للتعلم الخفي، تستعيد SALVE بنجاح المطالب القابلة للتفسير التي تُبرز سمة المعلم، في حين تفشل الأساليب الشائعة لتحسين النصوص في ذلك.

تمكنا أيضًا من استعادة سمة المعلم حتى عند فشل التعلم الخفي، مما يشير إلى أن تعديل تدريب الطالب لتحسين تقطير السياق يمكن أن يخلق تأثيرات التعلم الخفي. أخيرًا، تُظهر نتائجنا أن SALVE قادرة على الكشف عن تأثيرات التعلم الخفي في ثلاثة إعدادات إضافية: (1) خلط بيانات التعلم الخفي مع بيانات غير ذات صلة، (2) البيانات الناتجة عند انحياز المعلم عبر توجيه التنشيط، و(3) مجموعات فرعية من البيانات الحقيقية المختارة عبر اختيار اللوغاريتم الخطي.

بشكل عام، تعمق نتائج دراستنا في فهم التعلم الخفي وتقدم SALVE كمنهج للكشف الاستباقي عن تأثيرات هذا النوع من التعلم. هل تعتقد أن التعلم الخفي يمكن أن يحدث تأثيرات أكبر في مجال الذكاء الاصطناعي؟ شاركونا وجهة نظركم في التعليقات.