في دراسة جديدة تم نشرها، تم تناول مفهوم "فجوة المعرفة والقول" (Knowing-Saying Gap) وكيف تؤثر على أداء نماذج اللغة (Language Models). أظهرت النتائج التي نشرت على arXiv أن المستشعرات الخطية (Linear Probes) قادرة على اكتشاف السياقات الفاسدة بدقة قريبة من الكمال؛ لكن هذا لا يترجم إلى تنبؤات دقيقة حول الفشل. مما يجعل الوضع معقّدًا في مجالات رصد النشر.
عبر سلاسل حسابية متعددة الأبعاد، يتضح أن المستشعرات التي تكشف عن الفساد لا تقدم معلومات موثوقة عن صحة الإجابات النهائية. كما أن النماذج التي تُفرض عليها تنسيقات ثقة منظمة تفشل في تقديم تمييز بين قيمتين فقط، مما يؤدي إلى معدلات أخطاء غير متميزة.
فجوة المعرفة والقول: كيف تكشف المستشعرات الأخطاء التي تفوتها الثقة
تعرّف الدراسة الجديدة كيف تكشف المستشعرات ذات الدقة العالية الأخطاء في نماذج اللغة، لكنها لا تؤدي إلى توقع موثوق للفشل. تثير النتائج تساؤلات حول فعالية رصد الأخطاء في التطبيقات العملية.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
