في عصر الذكاء الاصطناعي الحديث، تُعتبر نماذج اللغة الضخمة (Large Language Models) من أبرز التطورات المبهرة في هذا المجال. لكن، ما هو تأثير السياق على ذاكرة هذه النماذج؟ دراسة جديدة تسلط الضوء على كيفية تأثير السياق في استخراج المعلومات، بعد أن تم اختبار كيفية تصرف النماذج عند تقديم تلميحات معينة.

تتمثل الفكرة الأساسية في أنه عندما نتعامل مع نموذج من نماذج اللغة الضخمة، فإن تقديم تلميح (prefix) من مثال تدريبي قد يعزز من احتمالية استمرار النص الأصلي بشكل ملحوظ. ومع ذلك، فغالبًا ما يتم استخدام هذه التلميحات مع سياقات أخرى مثل التعليمات أو الوثائق المسترجعة، مما يدفعنا لاستكشاف ما إذا كان هذا السياق يقلل من الذاكرة أو فقط يغير مجموعة المعلومات التي يمكن استخراجها.

لقد أظهرت النتائج أن الذاكرة التي يمكن استخراجها ليست مجرد سجل زائل؛ بل تتكون من نواة مقاومة للسياق وحدود حساسة للسياق. وكشفت الأبحاث أن العديد من العينات التي يمكن استخراجها دون سياق تبقى قابلة للاستخراج تحت سياق مسترجع، خاصة مع زيادة طول التلميح. الطريقة التي تؤثر بها السياقات على الحدود السطحية قد تكون مثيرة للدهشة، حيث يمكنها تخفيض بعض التعرضات، لكنها قد تسمح أيضًا بتفعيل معلومات جديدة لم تكن متاحة عند تقييمها بالاعتماد على التلميحات فقط.

تقول النتائج إن العمليات المُعززة بالاسترجاع (Retrieval-Augmented Generation) قد لا تُقلل بشكل فعال من مخاطر الذاكرة، حيث أن بعض البيانات تظل قابلة للاستخراج بشكل قوي، مما يجعل مسألة الأمان المعلوماتي أولوية أكبر يجب التعامل معها بجدية.