في تطور مثير ضمن مجال تقنيات ضغط الفيديو، تم الإعلان عن كوديك فيديو جديد يعتمد على تمثيلات عصبية ضمنية (Implicit Neural Representations) لتحقيق ضغط غير مسبوق. بالاعتماد على شبكة تمثيل جيبي sinusoidal representation network (SIREN)، يقوم هذا الكوديك بتخزين الفيديو والصوت كأوزان لهذه الشبكة، مما يجعلنا نرى تحولاً جذرياً في كيفية تعاملنا مع البيانات.
تعمل الشبكة من خلال تزويدها بإحداثيات زمنية ومكانية، لتحويلها إلى قيم RGB للألوان والمقادير الصوتية. تم تحسين تصميم الشبكة ليتضمن طبقات بدالة منفصلة لكل من الصوت والفيديو، مع مجموعة من الطبقات المخفية المتصلة بالكامل، وثلاثة فروع للإخراج: فرع للفيديو واثنين آخرين للصوت. تستخدم هذه الفروع لتقدير المفاضلة بين الإشارات الصوتية، مما يساعد على إزالة الضوضاء المتبقية.
الجزء المثير في هذا الكوديك أنه يمكنه تحقيق نسبة ضغط مدهشة، مقارنة بأعداد كبيرة من نماذج الضغط التقليدية مثل H.264 وHEVC. فمع اختبار على فيديو بحجم 6.08 ميغابايت، استطاع النظام الجديد تقليص هذا الحجم إلى 2.33 ميغابايت دون فقدان كبير في جودة المحتوى. تم الوصول إلى PSNR للفيديو 28.72 ديسيبل وPSNR للصوت 24.18 ديسيبل، مما يعكس كفاءة النظام الهائلة.
بالإضافة إلى ذلك، كان هناك تطوير نموج أولي يعمل عبر المتصفح يسمح بالتدريب ونقل وتفكيك هذه النماذج باستخدام WebRTC، مما يسهل عمليات المعالجة المتقدمة على المستخدمين.
إنها بلا شك خطوة جديدة ومثيرة في عالم تقنيات الفيديو والصوت، ويثير هذا الابتكار تساؤلات عديدة حول أين ستقودنا التقنيات المستقبلية في معالجة البيانات. هل تعتقد أن هذه التقنيات ستحدث ثورة في كيفية استهلاكنا للميديا؟ شاركونا آرائكم في التعليقات!
كوديك الفيديو المتطور: تخزين البيانات بالعصبية لتمثيلات الزمن والمكان!
يستخدم كوديك الفيديو الجديد تمثيلات عصبية لتخزين الفيديو والصوت بشكل مبتكر، مما يقلل حجم البيانات بشكل كبير. هذه التقنية تعد بتغييرات جذرية في كيفية معالجة وتخزين الوسائط المتعددة.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
