في عالم الحوسبة الكبيرة، يعد اكتشاف الأنماط غير المعتادة في السجلات أمراً حيوياً لضمان موثوقية النظام. ومع التطورات الأخيرة، تمكّن الباحثون من استخدام نماذج اللغات (Language Models) لتحسين أدائهم في الكشف عن الأنماط غير المعتادة. ولكن، تكشف الأبحاث الجديدة عن مشكلة جدية: فهذه الأنظمة غالباً ما تمنح تقديرات ثقة مبالغ فيها، مما يؤدي إلى بعض الأخطاء القاتلة في التنبؤات.

تظهر الدراسات أن الأنظمة تكافح بشكل خاص مع السجلات غير المعتادة في ظل عدم توازن حاد في الفئات، حيث تُعطى تقديرات ثقة عالية للتنبؤات الخاطئة. والأسوأ من ذلك، تظل مستويات الثقة في الأخطاء مفرطة حتى عندما تشير المقاييس التقليدية إلى حالة جيدة من المعايرة.

للتغلب على هذه المشكلة، قدم الباحثون نظاماً يسمى Log Reconstruction and Distance (LoRD). يعمل هذا النظام كإطار عمل خفيف الوزن لتحسين موثوقية اكتشاف الأنماط غير المعتادة. يعتمد LoRD على التعلم من نماذج موثوقية معينة لكل مسار وكان قائماً على تمثيلات ضمنية لعينات التحقق المصنفة بشكل صحيح، ويقوم بتقدير موثوقية التنبؤات من خلال قياس المسافات بين النسخ.

من خلال إعادة ضبط تقديرات الثقة الخاصة بالتنبؤات عالية المخاطر، يتمكن LoRD من تقليل الأخطاء المفرطة الثقة بينما يحتفظ في الوقت نفسه بالتنبؤات الموثوقة. أظهرت التجارب الواسعة، التي تمت على أربعة مجموعات بيانات كبيرة وقياسية، أن LoRD يعزز بشكل مستمر من موثوقية الثقة بشكل ملحوظ ويقلل من أخطاء الأنماط غير المعتادة دون التضحية بأداء الكشف.