في عالم الذكاء الاصطناعي، يُعتبر تحسين كيفية استيعاب المعطيات السياقية مسألة حيوية لنماذج اللغات الضخمة (Large Language Models). حديثًا، تم الإعلان عن بحث ثوري يهدف إلى تطوير برمجة سياقية أكثر كفاءة، مما سيمكن هذه النماذج من التعلم والتكيف بشكل أفضل مع المعلومات المتغيرة.

تحت عنوان "تحسين البرمجة السياقية للنماذج اللغوية الضخمة"، يقدم الباحثون دراسة جديدة تتمثل في مفهوم "تحديث الذاكرة مع التطور المتتابع" (MUSE). حيث قاموا بتطوير "MUSE-bench"، وهو نظام يهدف إلى تقييم كيفية دمج التحديثات والحفاظ على المعلومات غير المتأثرة بها.

تعد التحديات المرتبطة بهذا الابتكار غير مسبوقة، حيث تتطلب الحفاظ على الحالة العالمية للنموذج مع تعديل مساهمة شواهد الذاكرة، ونظرًا لأهمية هذا الأمر، تم طرح طريقة جديدة تُدعى "PLUME".

يمتاز PLUME بكونه طريقة تعليمية خالية من التدريب، حيث يقوم بإنشاء تمثيل شامل للتحديثات، ويقوم بتفعيل شواهد الذاكرة لتشكيل وجهة نظر محلية للمعلمات، ودمج تنبؤاتهم بطريقة مرنة أثناء عملية فك التشفير.

خلال تقييم شامل تم إجراؤه على MUSE-bench، أظهرت النتائج أن PLUME حققت تحسنًا ملحوظًا بنسبة 29.9% في متوسط ROUGE-L Recall، و54.9% في مقياس LLM-as-a-Judge. يمكن الوصول إلى رموز التعليمات البرمجية لهذه الطريقة الرائدة على الرابط: https://github.com/xiaobingshi-LLM/PLUME.

ما رأيكم في هذا التطور الثوري للنماذج اللغوية الضخمة؟ شاركونا في التعليقات!