في عالم الذكاء الاصطناعي، تبرز نماذج اللغات الضخمة (Large Language Models) كأدوات ثورية، ولكن السؤال الحقيقي هو: هل يمكن لهذه النماذج أن تطور قدراتها بمرور الوقت؟ لنستقصي ذلك من خلال إطار العمل الجديد ContinualSkillBench.

يُعتبر ContinualSkillBench أداة ديناميكية تهدف إلى تقييم التعلم المستمر للمهارات في سياق نماذج اللغات الضخمة. هذا الإطار يتعامل مع خمس مجالات تمثيلية، حيث يحتوي كل مجال على 100 مهمة مترابطة تزيد صعوبتها بالتدريج، مما يوفر فرصًا لإعادة استخدام المهارات عبر المهام المختلفة.

أحد أبرز نتائج التجارب هو أن التنفيذ المتسلسل يعزز الأداء بشكل عام، ومع ذلك، تتباين الفوائد بشكل ملحوظ وفقًا للنموذج والمنطقة. كما أن التعلم داخل السياق يؤدي أداءً مشابهًا للحفاظ الواضح على المهارات، مما يشير إلى أن الكثير من التحسن يأتي من التكيف مع السياق السابق والتغذية الراجعة، بدلاً من مجرد تجريد المهارات القابلة لإعادة الاستخدام.

على الرغم من ذلك، فإن المهارات المحددة لا تزال تقدم فوائد اختيارية للمهام التي تتطلب إجراءات قابلة لإعادة الاستخدام أو نتائج دقيقة.

تُظهر النتائج أيضًا أن النماذج الأقل قدرة تميل إلى تراكم مجموعات أكبر وأقل تنظيمًا من المهارات المتعلقة بالمهام. تشير هذه النتائج إلى أن آليات التطور الحالي للمهارات ضمن السياق يمكن أن تدعم التكيف المستمر، لكن ما زالت تكافح لتوحيد التجارب إلى مهارات قوية وقابلة للنقل.