في عالم الذكاء الاصطناعي، تظهر التقنيات الحديثة بشكل متسارع، ومن أبرزها تقنية "تكييف وقت الاختبار المعتمد على استقرار الثقة" (TASCO). في الآونة الأخيرة، بات تكييف وقت الاختبار خياراً مرجحاً يتيح تحسين قدرات التفكير لدى النماذج اللغوية الكبيرة (Large Language Models - LLMs).

تعتمد تقنية TASCO على مفهوم "الالتزام التنبؤي" الذي يوفر إشارة مستمدة من النموذج ذاته، مما يمكّن النماذج من الوصول إلى حالات فكريّة ذات ثقة أعلى دون الحاجة إلى مدقّقين خارجيين أو نماذج مكافآت. لكن الوضوح بأن زيادة الثقة لا تعني بالضرورة الصحة، حيث يمكن أن تظل النماذج متيقنة رغم وجود أخطاء في استدلالاتها.

تشير الأبحاث إلى أن التفكير الواثق قد يكون أكثر دقة إذا بقيت تلك الثقة مستقرة حتى تحت التغييرات الطفيفة. واستنادًا إلى هذا المبدأ، تقدم تقنية TASCO أسلوبًا يدمج الاستقرار المحلي داخل تكييف وقت الاختبار مع الحفاظ على النموذج ثابتًا في الوقت ذاته.

تعمل TASCO على تشغيل الاستقرار المحلي من خلال تحسين مقدمة مستوى المهام الخفيفة للغاية تحت استراتيجيتين سيئتي التغييرات: التغييرات العشوائية التي تعزز استقرار التوزيع عبر المسارات الناجمة عن مسبقات متغيرة مجاورة، والتغييرات الحساسة التي تستهدف أسوأ حالات الحساسية المحلية.

تظهر التجارب أن TASCO تحسن دقة التفكير وكفاءة الرموز عبر مجموعة متنوعة من نماذج LLM ومعايير التفكير، بينما تثبت التحليلات السلوكية أنها تحافظ على الثقة المستقرة تحت التغييرات المحلية دون تركيز مبكر لتوزيع النموذج التنبؤي.