في خطوة مبتكرة لإحداث ثورة في مجال التعليم، تم تقديم نظام ديناميكي يُحوّل الكتب المدرسية إلى فيديوهات تفاعلية. يعتمد هذا النظام الفريد على معالجة نصوص الكتب المدرسية المقررة في الهند (NCERT) وتحويلها إلى شروحات فيديو تتفاعل مع استفسارات المستخدمين مباشرة.

كيف يعمل هذا النظام؟ الأمر بسيط! يقوم المستخدم بتحميل ملف PDF يحتوي على نص الكتاب المدرسي ويطرح سؤالاً، ليقوم النظام بإنشاء فيديو يشمل شروحات تعتمد على المحتوى المقدم. يتم ذلك من خلال مسار أوتوماتيكي يجمع بين نماذج استرجاع المعلومات المدعومة بالتوليد (Retrieval-Augmented Generation - RAG) ومكونات الوسائط المتعددة.

الأمر المثير هو أن مرحلة استرجاع المعلومات (RAG) تم تحسينها خصيصًا لتتناسب مع بنية كتب NCERT، مما يجعلها فعالة في الحصول على محتوى مُستند إلى الأسئلة المطروحة. وعند تلقي استفسار المستخدم، يقوم النموذج باسترجاع المحتوى المناسب من PDF ووضع نصوص سردية متسلسلة تتوافق مع نمط الشرح المستخدم في الكتاب.

تُمرر هذه النصوص إلى وحدة Stable Diffusion التي تُنتج صورًا تتماشى مع المحتوى، وبالتالي يتم إنشاء مشاهد تتسلسل في الفيديو. وفي النهاية، يقوم نظام Google Text-to-Speech بإنشاء سرد متزامن يتناغم مع المشاهد المرئية، ليجعل الفيديو التعليم تجربة سلسة وغنية.

يُمثل هذا النظام نهجًا مبتكرًا لتحويل المحتوى التعليمي الثابت إلى تجربة تعليمية تفاعلية وجذابة، مما يُساعد المتعلمين على التفاعل مع المواد الدراسية بشكل أكبر وأفضل.

هذا المشروع يُبرز كيف يمكن لتقنيات الذكاء الاصطناعي أن تلعب دورًا مهمًا في تسهيل التعلم وجعل التعليم متاحًا للجميع بشكل أكثر فعالية.