في عالم الذكاء الاصطناعي المتطور، تعتبر النماذج اللغوية الكبيرة (Large Language Models) محور اهتمام الباحثين، حيث يسعى العلماء لفهم سلوك هذه النماذج بشكل أعمق. في هذا الإطار، تم إطلاق تجربة جديدة تحت عنوان PV-SST، وهي منصة اختبارات اجتماعية معتمدة على التصويت بين الأقران، تهدف إلى قياس سلوك نماذج الذكاء الاصطناعي في مجالات متنوعة.

أجري الاختبار عبر 448 تجربة متنوعة تتعلق بأربعة مواضيع، حيث تم استخدام نماذج متعددة الوزن بالإضافة إلى ثلاثة متغيرات أُخرى مفصلة مسبقًا. أظهرت النتائج أن التفاعل مع المشاركات السابقة المدعومة بتصنيفات من المستخدمين يعزز التشابه اللفظي بين النتائج النهائية، مما يُشير إلى أن إعدادات المجتمع يمكن أن تؤثر بالفعل على إنتاج النماذج.

ومع ذلك، لم تُظهر التجربة أي دليل قاطع على وجود مزايا للموارد الموزعة مقارنة بالمصدر الواحد، مما يثير تساؤلات حول فعالية التوزيع في تحسين الأداء. في الوقت نفسه، أفادت النتائج بتراجع ملحوظ في نسبة البقاء للعينات في اللوحة الأساسية.

هذه الدراسة لا تقيم التأثيرات على الأفراد أو المنصات الإنتاجية، بل ترتكز على تقييم سكاني لنماذج الذكاء الاصطناعي. بالنظر إلى هذه النتائج، يبقى السؤال: كيف ستؤثر هذه الفهمات الجديدة على تطوير واستخدام الذكاء الاصطناعي في المستقبل؟