في دراسة حديثة، استندت إلى تقنيات نفسية مبتكرة، تم التحقيق في إتقان نماذج اللغات الضخمة (Large Language Models) في كيفية تطبيق القواعد. تم تقديم إجراء جديد يقارن تنوع الأفكار التي تنتجها هذه النماذج بفهم جديد لدى البشر.

شملت الدراسة Experiment 1 مقارنة اتخاذ القرار القائم على القواعد بين البشر ونماذج اللغات الضخمة، حيث وجدت النتائج أن جميع النماذج المدروسة أظهرت نمطاً شبيهاً بالإنسان، سواء تم تقديم سيناريوهات تم إنشاؤها قبل أو بعد انتهاء فترة تدريبها. لكن، كانت هناك اختلافات غير متوقعة بين مجموعتين من السيناريوهات لدى البشر، ودلت النتائج إلى أن هذه الاختلافات قد تكررت كذلك في ردود نماذج اللغات الضخمة.

انتقلت دراسة Experiment 2 إلى التركيز على سمة سياقية في تطبيق القواعد البشرية: حيث إن البشر يعتمدون على نص القاعدة أكثر من غيره عند مواجهة ضغط الوقت. أظهرت النتائج أن بعض النماذج، مثل Gemini Pro و Claude 3، استجابت بشكل مماثل للبشر عند التعرض لضغوط الوقت، في حين أن نماذج أخرى مثل GPT-4o و Llama 3.2 90b لم تظهر ذلك.

تشير الأدلة المجموعة من هذه التجارب إلى أن نماذج اللغات الضخمة تتمتع بإتقان مُلفت لمفهوم القاعدة، مما قد يكون له آثار ملحوظة في مجالات اتخاذ القرار القانوني والاستقصاءات الفلسفية.

إلى أي مدى تتوقعون أن تصل هذه النماذج في المستقبل؟ شاركونا آراءكم!