في دراسة جديدة تم نشرها، تم تناول مفهوم "فجوة المعرفة والقول" (Knowing-Saying Gap) وكيف تؤثر على أداء نماذج اللغة (Language Models). أظهرت النتائج التي نشرت على arXiv أن المستشعرات الخطية (Linear Probes) قادرة على اكتشاف السياقات الفاسدة بدقة قريبة من الكمال؛ لكن هذا لا يترجم إلى تنبؤات دقيقة حول الفشل. مما يجعل الوضع معقّدًا في مجالات رصد النشر.

عبر سلاسل حسابية متعددة الأبعاد، يتضح أن المستشعرات التي تكشف عن الفساد لا تقدم معلومات موثوقة عن صحة الإجابات النهائية. كما أن النماذج التي تُفرض عليها تنسيقات ثقة منظمة تفشل في تقديم تمييز بين قيمتين فقط، مما يؤدي إلى معدلات أخطاء غير متميزة.