في عالم الذكاء الاصطناعي، تُعتبر نماذج اللغات الضخمة (Large Language Models) من الأدوات القوية التي يمكن أن تنتج نصوصاً سلسة وجذابة، ولكنها في بعض الأحيان قد تنتج محتوى خاطئ أو غير مدعوم بالأدلة المتاحة. هنا تظهر أهمية تطوير تقنيات لرصد الهلوسة التي قد تنتجها هذه النماذج.

تقنية D-Score تمثل خطوة جديدة ومثيرة في هذا الاتجاه، حيث تركز على دراسة الأبعاد الهندسية للتفاعلات الخفية داخل النموذج. بناءً على تحليل رياضي بسيط، يُحتسب D-Score من عملية واحدة فقط للنموذج، مما يجعله سهل الاستخدام وسريع التحقيق.

والفكرة وراء D-Score هي أنه عند معالجة النصوص التي تتعارض معلوماتها مع تلك المتاحة في الحالة الداخلية للنموذج، فإن التمثيل الخفي قد يخزن كل من المحتوى الذي تم التعبير عنه وبعض الأدلة المضادة أو عدم اليقين. وبالتالي، ينتشر المسار الخفي عبر اتجاهات إضافية مميزة، مما يمكن D-Score من رصد هذه الظاهرة.

لقد تم تقييم فعالية D-Score من خلال مقارنة النتائج على مجموعتي بيانات FAVA-Annotation وRAGTruth. أظهرت التجارب أن D-Score يُعد بمثابة إشارة قوية من الحالة الخفية لرصد الهلوسة، دون الحاجة إلى التحقق الخارجي أو خطوة الاسترجاع، مما يسهل عمليات التحقق الذاتي.

إن تقنية D-Score ليست فقط أداة لتحسين موثوقية نماذج اللغات الضخمة، بل تفتح آفاقاً جديدة لفهم كيفية معالجة هذه النماذج للمعلومات بشكل أعمق. لذا، تتجه الأنظار الآن نحو استكشاف المزيد من التطبيقات العملية لهذه التقنية الواعدة في مجالات متعددة.