في عالم الذكاء الاصطناعي الذي يتطور بسرعة، يبقى قياس التحيزات السياسية في نماذج اللغات الضخمة (LLMs) تحديًا مستمرًا، إذ يُمكن أن يظهر ذلك من خلال اختلافات دقيقة في التعبير والحجة والتفكير القانوني. وفي هذا السياق، تم تقديم "بوليبياز"، وهو إطار مضاد للحقائق يهدف لقياس كيفية تعامل نماذج اللغات الضخمة مع سيناريوهات النزاع القانونية بشكل مختلف اعتمادًا على البلدان المعنية.

يعمل بوليبياز على مقارنة الردود لتساؤلات متقابلة، حيث يتم تبادل هوية الدول بانتظام عبر علاقات جيوسياسية متنوعة، والانتهاكات القانونية، ومهام التفكير. بدلاً من تقليل التحيز إلى حكم واحد، يقوم إطار بوليبياز بتفكيك الفجوات في الاستجابة إلى خمسة أبعاد قابلة للتفسير.

تظهر النتائج من خلال دراسة 13 نموذجًا معاصرًا من نماذج اللغات الضخمة والتي تشمل عائلات وأحجام مختلفة، أن هوية البلدان والاتجاهات الشخصية للمستخدمين يمكن أن تؤثر بطريقة منهجية على كيفية وصف وتقييم والدفاع عن الأفعال المتكافئة تحت القانون الدولي. وبالتالي، تؤكد هذه النتائج على أن بوليبياز يقدم إطارًا دقيقًا لتدقيق التوازن السياسي والتملق في نماذج اللغات الضخمة.