لا شك أن الملاحة الذكية التي تعتمد على الرؤية واللغة (Vision-and-Language Navigation - VLN) تواجه تحديات عدة عند التعامل مع بيئات جديدة وغير مألوفة. تبرز أهمية نموذج AVERT-VLN الذي يقدم استراتيجية مبتكرة لمواجهة هذه التحديات، حيث يعتمد على استعادة الأخطاء بشكل مدروس والتفاعل مع البشر.

تتضمن هذه الاستراتيجية استخدام نظام مراقبة متكامل (Monitor) يعزز من قدرة النموذج على الحصول على الإرشادات التصحيحية عند الحاجة، مما يساعد على استعادة المهمة الجارية بعد أي انحراف في التنفيذ. يتم تعليم هذا النظام لمراقبة التناسق بين التعليمات المنفذة والتاريخ البصري والملاحظة الحالية.

يعتمد AVERT-VLN على مجموعة بيانات مُصنفة تُعرف باسم LOSTNAV DATASET، التي تحتوي على 20 ألف مسار متناقض مع تصنيفات انحراف محددة، لتعليم النموذج على التعرف على الانحرافات الدلالية. بعد فترة تدريب تهدف إلى تقييم تقدم التنفيذ، يقوم النظام بمراقبة النماذج بشكل متزامن، وعندما يتعرف على انحراف، يتوقف عن التنفيذ الذاتي ويطلب الإرشاد البشري للعودة إلى المسار الصحيح.

وبحسب الدراسات، حقق نظام AVERT-VLN نجاحًا ملحوظًا مع معدلات نجاح تصل إلى 76.2٪ و66.3٪ باستخدام اختبارات مختلفة مثل R2R-CE وRxR-CE. ومن المثير للاهتمام أن نفس واجهة المراقبة أثبتت قدرتها على تحسين معدلات النجاح عبر ثلاثة نماذج ملاحية مختلفة، مما يشير إلى فعالية هذه الاستراتيجيات لتعزيز الأداء في الملاحة الذكية.

هل تعتقد أن دمج الذكاء الاصطناعي مع التفاعل البشري هو مستقبل الملاحة الذكية؟ شاركونا آراءكم في التعليقات!