تسعى نماذج اللغة الكبيرة (LLMs) باستمرار إلى الحفاظ على التوازن بين اكتساب معرفات جديدة والحفاظ على ما تم تعلمه سابقًا، وهو ما يمثل تحديًا حقيقيًا في عالم الذكاء الاصطناعي. في خطوة مبتكرة، قدم الباحثون تقنية جديدة تُعرف باسم SVC، والتي تعزز التعلم المستمر من خلال تحديث قنوات معينة.
يواجه نموذج التعلم المستمر التقليدي مشكلة تُعرف باسم النسيان الكارثي، حيث يتسبب تعديل المعرفة الجديدة في فقدان المعلومات القديمة. على الرغم من وجود طرق مثل التحسين المستند إلى المعلمات القابلة للتكيف (PEFT)، إلا أن نقص الأساليب المناسبة لتحديد كيفية توزيع المرونة والاستقرار لا يزال يهدد تحقيق نتائج فعالة.
تستند طريقة SVC إلى مفهوم قنوات المتجه المنفرد، حيث تمثل كل قناة تحويلًا من الإدخال إلى الإخراج وتسمح بتحديث المعلومات الجديدة مع الحفاظ على القدرات المتعلمة مسبقًا. قبل بدء العملية، تعتمد SVC على بيانات محددة بالنطاق لتقييم فوائد التكيف لكل قناة، وتستخدم مجموعة بيانات عامة ثابتة فقط كنموذج لاسترجاع تاريخ التفعيل وتقدير تكلفة النسيان.
تظهر النتائج التجريبية عبر أربع عائلات من LLMs وثمانية مهام تطبيقية أن SVC تساعد في الحفاظ على القدرات المتعلمة مسبقًا بينما تحسن الأداء بشكل كبير مقارنة بأساليب PEFT التقليدية. توضح التحليلات الإضافية حول تقييم القنوات واختيارها أن التركيز الانتقائي على مستوى قناة المتجه المنفرد يمكن أن يكون حلاً فعالاً لتكيف LLM بصورة مستمرة.
في عالم يتزايد فيه الاعتماد على الذكاء الاصطناعي، يعد هذا التطور استثنائيًا وقد يفتح آفاقًا جديدة في مجال التعلم الآلي. ما رأيكم في هذا التطور؟ شاركونا في التعليقات.
تحقيق التوازن بين الاستقرار والمرونة: كيف تغيرت نماذج اللغة الكبيرة مع طريقة جديدة!
طور الباحثون طريقة جديدة لتحسين نماذج اللغة الكبيرة (LLMs) تُعرف باسم SVC، والتي تعزز القدرة على التعلم المستمر مع الحفاظ على المعرفة السابقة. تعتمد هذه الطريقة على تحديث قنوات معينة لتحسين الأداء دون فقدان المعلومات القيمة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
