في عالم الذكاء الاصطناعي (AI) المتسارع، نجد اليوم إطلاق نموذج مثير يُعرف باسم Astronex-World 1.0. يعد هذا النموذج أساسًا متكاملًا لإنشاء الفيديوهات التفاعلية بطريقة تتيح التحكّم الفعال. باستخدام تقنيتي text-to-video و image-to-video، يمكن للمستخدمين إدخال أوامر نصية أو لقطات أولية، ليقوم النموذج بتوقع حالات بصرية مستقبلية في إطار زمني متوافق، مما يمنح تجربة مشاهدة غامرة ومثيرة.

يتميز Astronex-World بكونه نموذجًا ثنائي الاتجاه يسمح بتوليد سياق كامل. كما يحتوي على نموذج سببي يُستخدم فيه الاهتمام المتبادل (cross-block attention) وتخزين المعلومات المتقاطعة. يتم تطوير وفهم البيانات بطرق مبتكرة، حيث يضع هذا النموذج في المقدمة أدوات وأساليب حديثة لجعل عملية الإبداع مرنة وقابلة للتوسع.

يتم تدريب هذا النموذج على مراحل، مما يمنحه القدرة على التحكم في الكاميرات والحركة بطريقة ثنائية الاتجاه. يمكنه إنتاج مقاطع فيديو بدقة 832x480 بسرعة 24 إطارًا في الثانية، وأبلغت الاختبارات عن تحقيق نتائج إيجابية موزونة على مقياس الأداء المعروف WBench. كذلك يحتوي على واجهات إدخال وإخراج مخصصة للأفعال لتسهيل تدريب الآلات للذكاء المُجسد (embodied intelligence) والقيادة الذاتية.

إن إطلاق Astronex-World 1.0 يعكس التوجه المستقبلي في صناعة المحتوى السمعي البصري، ويتيح لنا تطبيق أفكار جديدة في العالم الرقمي. فهل أنت مستعد لاستكشاف آفاق هذه التكنولوجيا الرائعة؟