أصبحت نماذج اللغة الضخمة (Large Language Models - LLMs) محط أنظار الجميع خلال الفترة الأخيرة، ليس فقط لقدرتها على تنفيذ مهام تتعلق باللغة الطبيعية والتعرف على الأنماط، بل أيضاً لفعاليتها في تعزيز أو حتى أتمتة وظائف الإدارة. في دراسة جديدة، تم تناول تقييم أداء هذه النماذج عبر سياقات مبتكرة تمثلت في أبحاث تعتمد على محاكاة ألعاب الأعمال.

النموذج الجديد قدم إطار عمل مبتكر متاح للجمهور، يستند إلى محاكي إداري يمكن الباحثين من إجراء اختبارات قابلة للتكرار لتقييم أداء نماذج متنوعة مثل Gemini وChatGPT وMeta AI وMistral AI وGrok.

في هذا الإطار، يتم إسناد مهام إدارة شركة تجزئة محاكاة إلى LLMs، حيث يتعين عليها اتخاذ قرارات رئيسية تتعلق بالتسعير، وحجم الطلب، وميزانية التسويق، والتوظيف، وتسريح العمال، والقروض، ونفقات التدريب، والبحث والتطوير، وتوقعات المبيعات والإيرادات. كل ذلك يتم ضمن بيئة تجريبية تمتد على مدار اثني عشر شهراً، حيث يتم تقديم تقرير شامل لكل شهر من الأشهر السابقة لمساعدة LLMs على اتخاذ قرارات مستندة إلى بيانات واضحة.

تم تصميم هذه المنهجية لمقارنة الأداء عبر مقاييس كمية مثل الأرباح والإيرادات وحصة السوق، ما يمكّن من تحليل قرارات LLMs من حيث التناسق الاستراتيجي، والقدرة على التكيف مع التغيرات السوقية، والمبررات المقدمة وراء تلك القرارات. يتيح هذا النهج للباحثين الخروج من مجرد مقاييس الأداء البسيطة، والتوجه نحو تقييم دقيق لعملية اتخاذ القرار على المدى الطويل.

هل تعتقدون أن الذكاء الاصطناعي يمكن أن يصبح جزءاً رئيسياً من إدارة الأعمال في المستقبل القريب؟ شاركونا آراءكم في التعليقات.