تحتل نماذج اللغة الصغيرة (Small Language Models) مكانة متزايدة في البيئات الخاصة التي تتطلب ضبطاً دقيقاً. تحديد اللحظة المثلى لتوجيه عمليات اتخاذ القرار يعتبر حيوياً، وخاصةً في السيناريوهات التي قد يكون فيها الخطأ مكلفاً. في دراسة جديدة، تم تقييم كيفية دعم الثقة المدروسة في اتخاذ القرار الآمن ودفع بعض النماذج إلى اتخاذ قرارات تعتمد على دعم بشري.

في هذه الدراسة، تم تقييم إحدى عشرة نموذجاً مُدرباً على التوجيه، تتنوع ما بين 0.5 مليار إلى 14 مليار معلمة، على مجموعتي بيانات تشملان 25,168 توقع محلي. النتائج النظرية تشير إلى أن ضبط الثقة يمكن أن يحدد ماهية ما يمكن أن توفره النماذج. فعلى سبيل المثال، كان من الملاحظ أن دقة النماذج تتأثر بانخفاض ثقتهم، مما يؤدي إلى ضرورة تطوير حلول مثل حساب درجة ملاءمة خطط الصورة.

تم الكشف عن أن ثلاث فقط من بين 22 نموذج-مهمة يمكن أن تحصل على استقلالية معتمدة لمستوى مخاطر دون 20%. كما أن إجراء تصحيح للانحراف بحسب ترتيب الإجابات في شكل الأسئلة المتعددة في TruthfulQA قد تم تحديده وإصلاحه، مما يعزز من موثوقية النتائج.

يؤكد هذا البحث على أهمية التحسين المستمر لنماذج اللغة الصغيرة، حيث يعزز ضبط الثقة من إمكانية استخدامها في مجالات معينة بشكل آمن ويعطي مزيداً من الفهم حول متى يجب على النماذج التخلي عن اتخاذ القرار لمصلحة العنصر البشري.