في عالم الذكاء الاصطناعي، حيث تعتبر الأنظمة الطويلة الأجل محور الابتكار، تم الكشف عن مشروع مثير يحمل اسم StateM. يواجه هذا النظام التحديات التي تصيب النماذج الذكية التقليدية، مثل فقدان تتبع الحالة، وعدم القدرة على تفعيل الدروس المستفادة من التجارب السابقة. باستخدام تقنيات جديدة مثل تسخير التحجيم (Harness Scaling)، يسعى StateM لجعل الأنظمة أكثر كفاءة وجودة خلال تنفيذ المهام.

تقوم الفكرة الأساسية وراء StateM على تنظيم التنفيذ حول حالات دائمة وسياق محلي مستدام، حيث يتم فحص الانتقالات وإعادة استعادة الممارسات الإجرائية. وبفضل هذه المعايير، تمكن StateM من تحقيق دقة تصل إلى 95.3% خلال 445 تجربة، ليحقق النجاح في جميع المهام البالغ عددها 89 مرة واحدة على الأقل.

نموذج GPT-5.6، والذي اعتمد عليه نظام StateM، شهد ارتفاعًا ملحوظًا في الدقة، حيث انتقل من 76.7% إلى 85.4%، متجاوزًا بكثير مستويات الأداء السابقة. ومن خلال تحسين بسيط للغاية بتكلفة لا تتجاوز 38 دولارًا، ارتفعت دقة نظام DeepSeek-V4 Flash أيضًا.

إن النتائج الإيجابية التي حققها StateM تؤكد على قدرة النماذج الذكية على التعلم والتكيف. بفضل قواعد التحسين الجديدة، تمكن النظام من تحويل النتائج السلبية إلى متطلبات تنفيذ فعالة، مما يجعل التحكم في العمليات أمرًا يمكن تطبيقه بوضوح. لمزيد من التفاصيل، يمكنكم زيارة GitHub repository الخاص بالمشروع.

ما رأيكم في هذه التطورات المذهلة في عالم الذكاء الاصطناعي؟ شاركونا في التعليقات!