في خطوات ثورية نحو فهم عميق للأعماق البحرية، تم تقديم نموذج C3-JEPA (Cross-View, Control-Conditioned, Context-Extended) كحل مبتكر لاستخدامه مع الروبوتات الغاطسة (ROVs) في مهام الإنقاذ الثقيلة تحت الماء. تعتمد التقنية على استخدام مجموعة من الكاميرات المدمجة التي ترصد وتستشعر البيئة المحيطة، مما يمكّن الروبوتات من التنبؤ بحالة الأجسام تحت الماء.

بدون الحاجة إلى أجهزة استشعار تلامسية، يتيح C3-JEPA التنبؤ بحالة الأجسام بناءً على تفاعلاتها مع الروبوت تحت تأثير الحركة المائية. يتمكن النموذج من دمج المعلومات المرئية من كاميرات متعددة لتشكيل فهم شامل حول السياق المحيط.

يستخدم النموذج تقنية تُعرف بالالتقاط الضعيف (Weak Binding) لتقليل تكلفة التوصيف، وهو فعال بشكل خاص في مهام الإنقاذ تحت الماء. وقد أظهرت التجارب أن النموذج يتفوق في نقل المعلومات الهامة المتعلقة بالمهام إلى عمليات الاستدلال المقترحة، مما يجعله خفيف الوزن ولكن مرتفع الكفاءة.

علاوة على ذلك، يوفر واجهة تنبؤية تدعم التحكم التنبؤي القائم على النمذجة (Model-Predictive Control) وتجهيز الروبوتات وتقنيتها للتعامل مع السيناريوهات المستقبلية المعقدة. في اختبارات على فيديوهات حقيقية تحت الماء، أظهر النموذج قدرته على استعادة حالة الأشياء بدقة، من خلال الكاميرات المحجوبة، ممّا يعكس قدرة C3-JEPA على تجاوز حدود المحاكاة إلى الواقع العملي.