في عالمنا المعاصر، تلعب نماذج اللغة الضخمة (Large Language Models) دورًا متزايد الأهمية في اتخاذ قرارات السلامة في المدن، بما في ذلك معرفة الأماكن الآمنة للمشي أو الإيجار أو السفر. ومع ذلك، هل تعكس هذه التقييمات الأخطار الفعلية التي تواجه السكان، أم أنها مجرد انعكاسات للأسماء المرتبطة بالأحياء؟

في دراسة حديثة، تم تحليل سبعة نماذج مُدربة خصيصًا تحت ثلاثة شروط تفصل بين الاسم والجغرافيا. تشمل هذه الشروط الأبعاد المعروفة فقط، الأسماء فقط، والأبعاد + الأسماء، وذلك عبر 186 حيًا في لوس أنجلوس وشيكاغو، مع ربط البيانات بجرائم العنف واستطلاعات المجتمع الأمريكي.

أظهرت النتائج أن تقييمات السلامة كانت شبه ثابتة عندما يعتمد التحليل على الأبعاد فقط، بينما كانت الأسماء تحمل معظم التباين بين الأحياء، حيث أظهرت ارتباطًا معتدلًا بالجرائم العنيفة. انخفضت تقييمات السلامة بشكل أكبر في الأحياء التي تعكس أكثر نسبة ضخمة من الفئات المهمشة محليًا (مثل نسبة السود في شيكاغو ونسبة اللاتينيين في لوس أنجلوس).

تقدم الدراسة دليلًا يؤكد أن تأثير الأسماء يتتبع النسب السكانية في جميع النماذج الستة. وفي حالة لوس أنجلوس، حيث يمكن فصلهما بشكل أكبر، استمر التأثير حتى عند التحكم في الجرائم والدخل. تظهر الدراسات اللاحقة أن الحذر الزائد يكون مقترنًا بشكل أكبر بأرقام القتل المبلغ عنها بالكامل بدلاً من الجرائم المدفوعة بالقرارات التقديرية.

بفضل هذه النتائج، يصبح من المهم جدًا التفكير في كيفية نشر نماذج اللغة الضخمة في البيئات التي تقدم النصائح ودعم القرارات، حيث أن تأثير الأسماء يحمل في طياته كل من الإشارات الحقيقية للجريمة والصور النمطية الديمغرافية.