في عالم البرمجة الدقيقة، يعاني الكثير من النماذج اللغوية الكبيرة من صعوبة التعامل مع لغات النمذجة النادرة مثل MiniZinc، التي تُستخدم في حل مشكلات جمع البيانات السريعة. في هذا السياق، قدمت دراسة جديدة بعنوان "تعلم2زنك" التي تبحث في إمكانية تحسين نماذج لغوية صغيرة (Small Language Models) تتراوح معلماتها بين 0.6 إلى 20 مليار معلمة، لتوليد نماذج MiniZinc صحيحة نحويًا وذات دلالة.
يتناول البحث التحديات التي تواجه النماذج اللغوية عند التعامل مع هذا النوع من اللغات، حيث تتركز معظم الأخطاء في تركيب الجمل. يظهر أن النماذج الشائعة مثل Qwen3 وLLaMa وGemma وGPT-OSS تعاني من دقة تنفيذ تقل عن صفر، مما يدعو إلى التفكير في طُرق جديدة لتحسين الأداء.
استراتيجيتنا المقترحة تعتمد على أسلوب "تمهيد الأخطاء عبر النموذج" (Cross-Model Error Bootstrapping) لجمع الأخطاء التركيبية من عدة عمليات تنفيذ لنماذج لغوية وتشكيل مجموعة بيانات لتدريب وتصحيح الأخطاء. من خلال هذه العملية، تم تحسين أداء النماذج اللغوية الصغيرة، مما أدى إلى نتائج مثيرة حيث وصلت دقة التنفيذ إلى 98%.
ومع ذلك، على الرغم من تحسن الأداء في دقة الشفرات مباشرةً، لا تزال الدقة في تقديم الحلول تعاني لتصل إلى 35%، مما يدل على أن تعزيز القدرة على التفكير المنطقي حول القيود لا يزال يتطلب المزيد من البحث والتطوير.
نأمل أن تسهم تقنيات تحسيننا وبياناتنا وموديلاتنا الموجهة نحو المصدر المفتوح في أبحاث مستقبلية حول ترجمة النصوص إلى نماذج، لفتح آفاق جديدة في هذا المجال.
ما رأيكم في هذه الإنجازات؟ وهل تعتقدون أن هناك مجال لتحسين أكثر في المستقبل؟ شاركونا في التعليقات!
تعلم2زنك: كيفية تحسين نماذج لغوية صغيرة لترجمة النصوص إلى نماذج باستخدام MiniZinc
تقدم الدراسة الجديدة نهجًا مبتكرًا لتحسين نماذج لغوية صغيرة من خلال التركيز على معالجة اللغة الطبيعية لمشكلات نماذج القيد مثل MiniZinc. النتائج تشير إلى دقة تنفيذ مذهلة تصل إلى 98% باستخدام تقنيات جديدة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
