في عالم الذكاء الاصطناعي، تُعتبر نماذج اللغات الضخمة (Large Language Models) من الأدوات القوية التي يمكن أن تنتج نصوصاً سلسة وجذابة، ولكنها في بعض الأحيان قد تنتج محتوى خاطئ أو غير مدعوم بالأدلة المتاحة. هنا تظهر أهمية تطوير تقنيات لرصد الهلوسة التي قد تنتجها هذه النماذج.
تقنية D-Score تمثل خطوة جديدة ومثيرة في هذا الاتجاه، حيث تركز على دراسة الأبعاد الهندسية للتفاعلات الخفية داخل النموذج. بناءً على تحليل رياضي بسيط، يُحتسب D-Score من عملية واحدة فقط للنموذج، مما يجعله سهل الاستخدام وسريع التحقيق.
والفكرة وراء D-Score هي أنه عند معالجة النصوص التي تتعارض معلوماتها مع تلك المتاحة في الحالة الداخلية للنموذج، فإن التمثيل الخفي قد يخزن كل من المحتوى الذي تم التعبير عنه وبعض الأدلة المضادة أو عدم اليقين. وبالتالي، ينتشر المسار الخفي عبر اتجاهات إضافية مميزة، مما يمكن D-Score من رصد هذه الظاهرة.
لقد تم تقييم فعالية D-Score من خلال مقارنة النتائج على مجموعتي بيانات FAVA-Annotation وRAGTruth. أظهرت التجارب أن D-Score يُعد بمثابة إشارة قوية من الحالة الخفية لرصد الهلوسة، دون الحاجة إلى التحقق الخارجي أو خطوة الاسترجاع، مما يسهل عمليات التحقق الذاتي.
إن تقنية D-Score ليست فقط أداة لتحسين موثوقية نماذج اللغات الضخمة، بل تفتح آفاقاً جديدة لفهم كيفية معالجة هذه النماذج للمعلومات بشكل أعمق. لذا، تتجه الأنظار الآن نحو استكشاف المزيد من التطبيقات العملية لهذه التقنية الواعدة في مجالات متعددة.
D-Score: تقنية مبتكرة لرصد الهلوسة في نماذج اللغات الضخمة
تمثل تقنية D-Score تقدماً هاماً في كشف الهلوسة في نماذج اللغات الضخمة، مستخدمة طريقة رياضية بسيطة تعتمد على التفاعلات الخفية. النتائج تشير إلى فاعلية هذه التقنية في تصنيف النصوص بشكل دقيق.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
