تشهد مجالات الاكتشاف العلمي مثل الرياضيات والعلوم اعتماداً متزايداً على نماذج اللغة الكبيرة (Large Language Models) لتحقيق نتائج دقيقة في معالجة البيانات. الطريقة التقليدية تتمثل في تقديم المشكلة للنموذج واستخدام إجابته كحل مقترح. ولكن، ما يثير الفضول هنا هو أنه يمكن تعزيز الاكتشاف من خلال زيادة القدرة الحسابية في وقت الاختبار. يُعرف هذا الأسلوب باسم pass@k، حيث يُسمح للنموذج باستكشاف فضاء الحلول وتوليد خيارات مرشحة متنوعة.
لكن العائق أمام فعالية هذه العملية يكمن في طريقة التعلم المعزز (Reinforcement Learning) التقليدية المستخدمة بعد تدريب نماذج اللغة، حيث قد يضيق توزيع مخرجات النموذج حول الحلول العالية المكافأة، مما يؤدي إلى تقليص نطاق الحلول المتاحة.
لحل هذه المشكلة، تقترح هذه الدراسة استخدام استراتيجيات التطور (Evolution Strategies)، وهي طريقة تعتمد على جماعية التحسين دون استخدام التدرجات، وتركز على تحسين النماذج من خلال الاضطرابات العشوائية في مساحة الأوزان. أظهرت نتائج البحث أن استراتيجيات التطور تحقق نتائج pass@k أعلى بشكل ملحوظ من التعلم المعزز، كما أنها تنتج توزيع مخرجات أوسع مع تغطية وحلول أعمق.
غالباً ما تسهم هذه التغطية الأكبر في تحقيق نتائج أفضل خصوصاً في اختبارات الرياضيات القياسية، مما يجعل استراتيجيات التطور أساساً أفضل لعمليات ما بعد التدريب في المجالات الاكتشافية وأي مجالات أخرى تتطلب تغطية متنوعة للحلول.
هل تعتقد أن استراتيجيات التطور ستحدث ثورة في عالم الاكتشافات العلمية؟ شاركونا آرائكم في التعليقات.
استراتيجيات التطور: كيف تعزز نماذج اللغة الكبيرة من دقة الاكتشافات العلمية؟
يتمثل التحدي الكبير أمام نماذج اللغة الكبيرة (LLMs) في تحسين دقة الاكتشافات العلمية، حيث يتيح استخدام استراتيجيات التطور (Evolution Strategies) تجاوز القيود التقليدية. نتائج الدراسة تظهر أداءً متفوقاً لاستراتيجيات التطور مقارنة بأساليب التعلم المعزز.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
