تشهد تكنولوجيا الذكاء الاصطناعي تقدمًا مثيرًا في مجالات متعددة، من بينها توليد الفيديوهات حيث قامت شركة VideoCoCo بتقديم نموذج مبتكر يحمل اسم VideoCoCo، والذي يعتمد على إطار عمل مزدوج وقابل للتنفيذ.

في عالم تتسابق فيه الشركات لتقديم أفضل نماذج الذكاء الاصطناعي، كان هناك تحدٍ كبير أمام النماذج السابقة وهو قدرتها على إنتاج فيديوهات تتسم بالديناميات الفيزيائية المتسقة. غالبًا ما كانت هذه النماذج تعتمد على توجيهات نصية مضغوطة، مما أدى إلى نتائج قد تكون بعيدة عن الواقعية.

تنتقل VideoCoCo بخطوة واضحة إلى الأمام من خلال استخدام كود Blender كحلقة تفكير على مستوى العمليات. يتيح لنا هذا النظام، عند إدخال موجه نصي، تكوين برنامج Blender يحدد بوضوح المشهد وتطوره الزمني. وعندما يتم تنفيذ هذا البرنامج، يمكن لنظام المحاكاة إنتاج مسودة زمنية يمكن بعدها تحويلها إلى فيديو واقعي باستخدام محرك فيديو توليدي.

تعتبر هذه التطورات ملحوظة خاصة أنها تفصل بين عملية التفكير على مستوى العمليات وتحقيق نتائج بصرية عالية الدقة. تم بناء مجموعة بيانات VideoCoCo-3K لتكييف محرر الفيديو مع المسودات المُعتمدة، مما يعزز أيضًا جودة النتائج.

ووفقًا للاختبارات، تحسن VideoCoCo النتائج بنسبة ملحوظة على أدوات التقييم الخاصة بـ PhyGenBench وVBench-2.0، مما يبرز فعالية الكود القابل للتنفيذ كوسيلة فعالة ومراقبة لتوليد فيديوهات تتسم بالاتساق الفيزيائي.

تعد هذه التقنية مثارًا للإعجاب، فهي ليست فقط تمثل تكنولوجيا جديدة، بل تسهم أيضًا في رسم ملامح مستقبل إنتاج الفيديو بواسطة الذكاء الاصطناعي. مع التقدم المستمر، يبقى السؤال: كيف ستؤثر هذه الابتكارات على صناعة الإعلام؟ شاركونا آرائكم في التعليقات!