تسعى الأبحاث الحديثة في مجالات الذكاء الاصطناعي باستمرار إلى تعزيز القدرة على التفكير في نماذج اللغات الضخمة (Large Language Models). في خطوة مثيرة، ظهرت فكرة جديدة تتمحور حول التضمينات العشوائية (Random Soft Prompts)، والتي تلغي خطوة التدريب بالكامل وتضيف تسلسلاً جديدًا من التضمينات العشوائية إلى مدخلات النموذج.

تكمن براعة هذه الفكرة في أنها تستمد كل تضمين عشوائي من توزيع غاوسي ذو أبعاد متساوية، مما يمنح النموذج فرصًا لاستكشاف مدى واسع من الخيارات. رغم أن هذه التضمينات لا تحمل أي محتوى تعلم مسبق، إلا أنها تحقق دقة مشابهة للتوجيهات اللينة المحسنة (Optimized Soft Prompts) ضمن اختبارات التفكير الرياضي.

الآلية التي تعمل بها هذه التضمينات تجري على مرحلتين؛ ففي البداية، يتعين على الانتباه (Attention) التعامل مع مواقع جديدة تمامًا، مما يؤدي إلى تنويع كبير في الرموز الناتجة. مع استمرار عملية التوليد، يصبح التأثير اقل وضوحاً حيث يتجه النموذج نحو استجابة واحدة محددة.

عبر تجارب متعددة، أثبتت التضمينات العشوائية قدرتها على زيادة تنوع الرموز في المرحلة المبكرة من الاستنتاج، مما يعزز إمكانية حصول استجابة صحيحة واحدة على الأقل خلال محاولات متعددة. وعلاوة على ذلك، تمتد هذه الفوائد إلى مراحل التدريب، حيث أظهرت المتغيرات العملية تحسناً ملحوظاً.

تجذب هذه البحوث الأنظار لعدة أسباب: أولاً، تمثل التضمينات العشوائية الشكل الأبسط من أشكال التوجيه اللين، كونها غير مرتبطة بالتدريب، مما يمنح رؤية موحدة لتأثير حقن التضمينات. ثانيًا، تقدم هذه الدراسة ت Validation نظرية وتجريبية للآلية الأساسية. وثالثًا، تقوم بتوسيع آثار ذلك من المرحلة الاستنتاجية إلى مرحلة التدريب.

في الختام، تمثل هذه الأبحاث خطوة مثيرة في مسار تحسين النماذج اللغوية، مما يفتح أبواب جديدة أمام مستقبل الذكاء الاصطناعي. ما رأيكم في هذا التطور؟ شاركونا في التعليقات.