تُعتبر تقنية التكميم (Quantization) واحدة من الطرق الفعّالة لتعزيز توزيع نماذج اللغة الكبيرة، ولكنها قد تؤثر سلبًا على سلوك عدم اليقين، مثل مستوى الثقة والهوامش وقابلية العدول. في دراسة جديدة، تم استعراض كيفية معالجة هذه المشكلة من خلال اختيار بيانات المعايرة (Calibration Data) بطريقة معتمدة على الهدف.

تتباين الأنظمة في مقدار التركيز على مناطق معينة من توزيع الإدخال، لكن غالبية الأعمال السابقة تركزت على تحسين مقاييس الضغط التي تركز على الدقة، أو تعديل النتائج بعد فترة التكميم. تطرح الدراسة مفهوم "تكميم الحفاظ على الشك" (Doubt-Preserving Quantization) كطريقة مبتكرة تستخدم التوقعات بدقة كاملة لبناء مزيج من البيانات المعايرة المتوافقة مع الهدف، والتي تحتوي على أمثلة ذات شك عالي ومرتكزات عامة.

تجارب متعددة شملت 8 نماذج لغوية و9 اختبارات معالجة لغة طبيعية و22 طريقة مقارنة أظهرت أن الطريقة الأكثر فعالية في الحفاظ على الهدف تختلف حسب نوع النموذج المستخدم. على سبيل المثال، أظهرت الطريقة DPQ-r75 أداءً متميزًا في الحفاظ على حدود الإجابة في اختبارات SQuAD2، بينما أظهرت النماذج الأخرى، مثل DPQ-r50، أداءً أفضل في الحفاظ على سلوك الأسئلة متعددة الخيارات.

تشير هذه النتائج إلى أهمية اختيار بيانات المعايرة بناءً على سلوك النتائج بدقة عالية الذي يحتاجه النموذج، بدلاً من اعتبارها تفاصيل ثابتة في عملية التكميم.