تعتبر نماذج اللغة الضخمة (Large Language Models، LLMs) واحدة من أهم أدوات الذكاء الاصطناعي التي تعتمد عليها العديد من التطبيقات الحديثة. ومع ذلك، تواجه هذه النماذج تحديًا كبيرًا يتعلق بهلاوسها، حيث تميل إلى إنتاج محتوى غير دقيق أو مضلل. في دراسة جديدة نشرت على موقع arXiv، تم اقتراح إطار عمل مبتكر للكشف عن هذه الهلاوس على مستوى الحقول المختلفة، وهو ما يتيح تحسين القدرة على تحديد الهلاوس مقارنةً بالطرق التقليدية.

في حين أن الأساليب الحالية تعتمد عادةً على أنظمة الاسترجاع الخارجية والتي تعتبر بطيئة، فإن الاستفادة من الاستقصاءات الداخلية لنماذج اللغة الضخمة توفر بديلًا واعدًا. ومع ذلك، فإن هذه الأساليب غالبًا ما تقصر مهمة الكشف عن الهلاوس إلى تصنيف ثنائي على مستوى الرموز، مما يفشل في التقاط الحدود الهيكلية والتسلسلية للتحول المعنوي.

من خلال تحليل الأنماط التنشيطية على مستوى الطبقات، تأمل الدراسة في اكتشاف بداية الهلاوس واستمرارها في توليد لمددت من نماذج اللغة. وقد أظهرت التجارب المقدمة أنه يمكن عزل بدايات الهلاوس بدقة، محققة تحسنًا كبيرًا في مقاييس Precision-Recall AUC مقارنةً بالحدود العشوائية، على الرغم من عدم التوازن الشديد في الفئات.

تقدم الدراسة إطار عمل جديد للكشف المتبادل بين النماذج، حيث يمكن لنموذج واحد أن يراقب التمثيلات الداخلية الناتجة عن توليد نموذج آخر. ووجد الباحثون أن المراقب الخارجي يمكن أن يتطابق أو حتى يتجاوز اكتشاف نموذج المولد لبدايات هلاوسه، مما يشير إلى أن القدرة على اكتشاف الهلاوس لا تتوقف عند نموذج المولد نفسه، حتى لو كان المراقب نموذجًا أصغر.

في الختام، يدعو الباحثون المجتمع الأكاديمي والصناعي إلى استكشاف هذا الإطار الجديد، مما يعد بفتح آفاق جديدة في تحليل وتطوير نماذج اللغة الضخمة.