في عالم الفيديوهات والتحكم في الحركة، يظهر لنا نظام مُصوِّر الجيل الجديد (Generative Cinematographer) كمبتكر خارق في مجال إنشاء المحتوى. غالبًا ما تستند أنظمة توليد الفيديو الحالية إلى مسارات حركة ثنائية الأبعاد، مما يؤدي إلى غموض في التحكم. فمثلاً، يمكن أن تُمثل نفس المسار حركةً ثلاثية الأبعاد مختلفة اعتمادًا على ما إذا كانت الكاميرا والأجسام تتحرك في الوقت نفسه أو لا.

يسمح نظام (GenCine) الجديدة للمبدعين بإنشاء مشهد ثلاثي الأبعاد قابل للتعديل انطلاقًا من صورة واحدة، حيث يستطيع الفنانون التأليف المشترك لحركات الكاميرا وحركات الأجسام في المقدمة. يُمكّن النظام الفنانين من تحديد مسار للكاميرا وتحريك المناطق المختارة في المقدمة باستخدام مقابض حركة ثلاثية الأبعاد محلية.

تتيح هذه المقابض القدرة على تحريك أجزاء مختلفة من الكائن بشكل مستقل، مما يوفر تقريبًا متقطعًا لحركة غير صلبة بدون الحاجة إلى مُحاكي فيزيائي أو معلومات مسبقة عن الفئة. وبفضل ذلك، يمكن التحكم في حركة الأجسام بالنسبة للمشهد حتى أثناء حركة الكاميرا.

لتقديم هذه التحسينات إلى نموذج الفيديو المدرب مسبقًا، يتم تحويل هذه الضوابط إلى خرائط توجيهية. تختلف ميزات كل مقبض عبر إطارات الفيديو، حيث يمكن التعرف على كل مقبض بلون ثابت ينسجم مع مواقعها ثلاثية الأبعاد. أدت هذه العملية إلى تحسين الحركة المستندة إلى الكاميرا وزيادة التناسق الهندسي عند تغيير وجهات النظر، مما يُظهر تحكمًا قويًا في مشاهد العالم الحقيقي.

تستند عمليات التدريب للنظام إلى استعادة الضوابط من الحركة الملاحظة في فيديوهات حقيقية، واستخدام هندسة ومسارات حقيقية من فيديوهات اصطناعية، مما يُعد خطوة كبيرة نحو مستقبل إنتاج الفيديوهات.