في عالم الذكاء الاصطناعي، تتزايد التحديات المرتبطة بتقديم دقة عالية في التنبؤات، خاصةً عند التعامل مع مجموعات بيانات صغيرة. أحد التقنيات الحديثة التي تكتسب شهرة هي طريقة TabPFN، التي تعتمد على أسلوب التعلم في السياق (in-context learning). يُمكن لهذه التقنية التنبؤ بتسميات الاختبار دون الحاجة إلى تحديثات متكررة على نماذج البيانات، بل من خلال الاعتماد على مجموعة من الصفوف المُعلمة مسبقًا (السياق أو النماذج الأولية).

درست دراسة حديثة كيفية اختيار حجم السياق والصفوف التي تشكل هذا السياق وتأثيرها على استقرار التنبؤ ودقته، باستخدام عينات سياقية متكررة عبر 15 مجموعة بيانات من OpenML. تمحورت الأسئلة الرئيسية حول ما إذا كانت السياقات الأكبر تُقلل من تقلبات التنبؤ، وإذا كانت دقة التنبؤ تتأثر بالاحتفاظ بتوزيع التدريب أو تغطية مساحة الخصائص.

نتائج الدراسة أظهرت أن السياقات الأكبر ليست فقط أكثر دقة، بل أيضًا أكثر استقرارًا بوضوح. عل مثال، انخفض معامل التباين في AUC من حوالي 18% إلى 4% عند زيادة حجم السياق. أيضا، بينت التجارب أن الحفاظ على تمثيل توزيعي صحيح في السياقات العشوائية ساعد في تحقيق دقة أعلى.

على الرغم من أن أساليب الاختيار المكلفة مثل K-Means وجمع النقاط الأبعد لم تقدم تحسينات ملحوظة مقارنةً بالاختيار العشوائي، فإن النتائج تؤكد على ضرورة اختيار سياق متنوع بدلاً من التركيز فقط على مطابقة المتوسطات.

في الختام، يقدم هذا البحث رؤية جديدة حول كيفية استخدام أسلوب TabPFN بفعالية لتحسين التنبؤات في البيئات التي تعاني من نقص البيانات، مزودًا بتوجيهات عملية لمن يرغب في توظيف هذه التقنية في تطبيقاتهم الخاصة.