في عالم الذكاء الاصطناعي، يلعب ترميز الحالة (state encoding) دورًا محوريًا في سلوك الوكلاء المعتمدين على نماذج اللغة. في دراسة جديدة، تناول الباحثون استخدام نماذج لغوية مسبقة التدريب لتصميم تجربة تزامن دائري، حيث أثبتوا أن نوع الترميز المستخدم يمكن أن يؤثر بشكل كبير على النتائج الجماعية.
ركزت تلك التجربة على عمل الوكلاء، والذين يتم منحهم معلومات ملخصة فقط عن حالات جيرانهم، ما يتيح لهم اتخاذ قرارات تتعلق بالتقدم أو التوقف أو الإبطاء. كان لافتًا أن ترميز الحالة على هيئة لحظات دائرية (circular moments) أدى إلى نتائج جماعية متزامنة في 6 من 6 حالات، بينما فشلت الترميزات القائمة على الهستوغرام (histogram encodings) في تحقيق أي نتائج متزامنة.
علاوة على ذلك، تحقق التأثير المذهل عند إعادة تشغيل الحقول المتطابقة، حيث تغيرت احتمالات سلوك كل وكيل بشكل ملحوظ في نماذج GPT وClaude وGemini. مما يشير إلى أن ترميز الحالة ليس مجرد واجهة تبادلية، بل يشكل جزءًا من قانون تفاعل فعال يعتمد على النموذج.
تقلل هذه النتائج من فكرة أن البيانات يمكن أن تُعتبر مجرد واجهات خالية من التأثير. بل، إن ترميز الحالات يشكل محور الأساليب التفاعلية بين الوكلاء، مما يستدعي مزيدًا من الفهم في كيفية تأثير هذه النماذج على نتائجها الجماعية.
استكشاف الديناميكيات الجماعية في نماذج اللغة: تأثير الترميز على النتائج
تسلط هذه الدراسة الضوء على كيف يمكن أن تؤثر الطريقة التي يتم بها ترميز الحالة (state encoding) على النتائج الجماعية في نماذج اللغة. باستخدام تجربة تزامن دائري، توضح النتائج أهمية نماذج البيانات في تشكيل سلوك الوكلاء.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
