تستخدم الأنظمة متعددة الوكلاء المعتمدة على نماذج اللغات الضخمة (LLM) بشكل متزايد لحل المهام المعقدة من خلال التفكير المنسق، واستخدام الأدوات، والتفاعل مع الموارد الخارجية. ولكن، لا يزال توجيه الأخطاء في هذه الأنظمة يمثل تحديًا كبيرًا، حيث أن النتيجة المرصودة لا تكشف في كثير من الأحيان عن الخطأ المعني بالتحويل الفاشل. في هذا العمل، نسلط الضوء على هدف التخصيص الذي يتمثل في الخطأ الحاسم، وهو عبارة عن زوج الوكيل-الخطوة الذي سيؤدي تصحيحه إلى استرداد التنفيذ الفاشل.

تقنيات التحليل الحالية غالباً ما تحدد الخطوات المشبوهة دون نمذجة واضحة لكيفية انتشار الأخطاء عبر التفاعلات أو استمرارها في الحلقات غير المحلولة، مما يجعل من الصعب تمييز الأخطاء الحاسمة عن أعراض الفشل الناتج.

نقترح نموذجًا مبتكرًا يسمى
**نموذج انتشار الأخطاء لتحليل الفشل (EMFA)**، والذي يقوم بإنشاء تمثيل هيكلي للمسار الفاشل، وينمذج كل من انتشار الأخطاء بالتتابع والحلقات التفاعلية المستمرة. يستخدم EMFA تقنيات فرز مرشحة واعية بانتشار الأخطاء، تليها عملية التحقق المضادة للحقيقة لتحديد الزوج الحاسم للوكيل-الخطوة.

سيتم تقييم النموذج على معيار Who&When، حيث حقق EMFA دقة متفوقة في تحديد الخطوات وتظل النتيجة تنافسية بمستوى الوكيل. هذا النموذج يعزز من دقة النتائج السابقة بمعدل يتراوح بين 3.45 و4.40 نقطة مئوية في أقسام البيانات المصنوعة يدويًا والمولدة بواسطة الخوارزميات، على التوالي.

إن نموذج EMFA يعيد تعريف كيف يمكن تقليل صعوبة توجيه الأخطاء في الأنظمة المعقدة، مما يوفر رافعة قوية لفهم وتحليل الأخطاء بشكل أفضل. هل أنتم مستعدون لاكتشاف المزيد عن هذا الابتكار؟