في عالم الذكاء الاصطناعي، تُعتبر نماذج اللغة الضخمة (Large Language Models) من أبرز الابتكارات التي تقدم دقة عالية في معالجة اللغة الطبيعية. ومع ذلك، يبقى السؤال: ما هي المهارات المنطقية الأساسية التي تتقنها تلك النماذج؟ هنا يأتي دور معيار LogicSkills الجديد، الذي تم تطويره لاستكشاف وقياس تلك المهارات.

يستند معيار LogicSkills إلى ثلاثة مهارات منطقية أساسية:
1. **الرمزية الرسمية** (Formal Symbolization): ترجمة الفرضيات إلى منطق من الدرجة الأولى.
2. **بناء النماذج المضادة** (Countermodel Construction): إثبات أن حجة ما غير صحيحة من خلال بناء نموذج مضاد محدود.
3. **تقييم الصحة** (Validity Assessment): تحديد ما إذا كانت نتيجة ما تتبع من مجموعة معينة من الفرضيات.

تستند العناصر المستخدمة في هذا المعيار إلى قطعة من منطق الدرجة الأولى بدون هوية، وتُقدم باللغتين الإنجليزية ولغة كلمات كاروليان. علاوة على ذلك، تم تحقق صحة جميع الحالات بشكل دقيق بمساعدة الأداة Z3.

تظهر النتائج أن نماذج اللغة التقليدية المعززة بالتعليم تُظهر أداءً عاليًا في تقييم الصحة، إلا أن أدائها في الرمزية الرسمية وبناء النماذج المضادة يتسم بالضعف. وهذا يشير إلى أن دقة المهمة على مستوى عالٍ يمكن أن تخفي نقاط ضعف حقيقية في المهارات المنطقية الأساسية.

وعلى النقيض من ذلك، أظهرت النماذج الحديثة الموجهة نحو التفكير أداءً قويًا عبر جميع المهام الثلاث، مما يشير إلى ملف تعريف مهاري منطقي أكثر نظامية.

إن معيار LogicSkills يفتح آفاقًا جديدة لفهم أعمق لقدرة هذه النماذج ويساعد المطورين والباحثين على تحسين الأداء المنطقي، مما يعد خطوة مهمة نحو تحقيق الوعي الحقيقي في الذكاء الاصطناعي.