نحن في عصرٍ تتقدم فيه التكنولوجيا بشكل مذهل، حيث أصبحت نماذج اللغات الضخمة (Large Language Models) جزءًا لا يتجزأ من طرق التعليم الحديثة. لكن، ماذا عن الفهم العميق لكيفية تصرف هذه النماذج في سيناريوهات التعلم الحقيقية؟ في دراسة جديدة، تم تقديم إطار تقييم يستند إلى السيناريو، يكشف كيف يمكن لنماذج اللغات الضخمة إحداث فرق كبير في تقديم الدعم التعليمي الشخصي.

تستند هذه الدراسة إلى مثال عملي من الفصل الدراسي، حيث تم اختبار مجموعة من نماذج اللغة الكبيرة باستخدام بيانات تتعلق بإجابات الطلاب على أسئلة حول الهياكل البيانية. تطلب كل نموذج التعرف على المفاهيم المعرفية الأساسية، واستنتاج مستوى الإتقان لدى الطلاب، وتقديم إرشادات مخصصة لتحسين الأداء.

وللضمان مقارنة شاملة وقابلة للتكرار، تمت الاستعانة بنموذج "جمني" (Gemini) كمقياس خارجي لينظر في عدة جوانب تعليمية حيوية، مثل دقة التشخيص ووضوح التعليمات وقابلية التنفيذ. بعد ذلك، تم استخدام نموذج "برادلي-تيري" (Bradley-Terry) لاشتقاق تقديرات القوة التنافسية.

أظهرت النتائج أن كل نموذج من نماذج اللغات الضخمة يظهر سلوكيات تربوية متميزة في نفس سياق التعلم. وهذا يعكس إمكانات عظيمة لتقييم هذه النماذج بطريقة مفيدة تعليميًا، مما يساعدنا على فهم سلوكها في بيئات التعليم المدعومة بالذكاء الاصطناعي. كيف يمكن أن يؤثر ذلك على مستقبل التعليم؟