في عالم اليوم، يعد تحرير الفيديو من المجالات الحيوية التي تحظى باهتمام كبير، ولكن لا يزال هناك الكثير من التحديات التي تواجهها تقنيات التحرير الحالية. وفي هذا السياق، تم الكشف عن **ViTeX-Bench**، مجموعة تقييم مبتكرة تهدف إلى تحسين تحرير النصوص في مشاهد الفيديو مع الحفاظ على جودة المشهد الأصلي.

تحرير نصوص المشاهد (Scene Text Editing) يُعد مهمة معقدة، حيث يتطلب الأمر استبدال النصوص على الأسطح المختلفة مثل لافتات المتاجر والسبورات، مع الحفاظ على المحتوى المحيط وحركة الكاميرا. بينما تم دراسة هذا المجال بشكل واسع في الصور، فإن تحرير النصوص في الفيديوهات لا يزال يعاني من نقص في الموارد والبيانات اللازمة لتحقيق الجودة المطلوبة.

تتضمن مجموعة بيانات **ViTeX-Dataset** ما مجموعه 387 فيديو عالي الجودة بدقة 720 بكسل، مصنفة مع تعليمات التحرير ومناطق النص المعنية. من بين هذه الفيديوهات، 230 فيديو تقدم تعديلات تم مراجعتها بواسطة نظام الأنابيب للتدريب، و157 فيديو تم اختيارها كتشكية للتقييم.

تستخدم مجموعة ViTeX-Bench بروتوكول تقييم يتضمن 13 مقياسًا مختلفًا، مما يسمح بقياس دقة النص وجودته البصرية والزمنية. حيث تم الاستناد إلى تحليلات دقيقة مثل **OCR calibration** وتقييمات بشرية لتحقيق فهم أفضل لنتائج القياس.

أحد النتائج المثيرة هو **ViTeX-Edit-14B**، محرر مفتوح المصدر تم تدريبه ليكون قادرًا على تحقيق نتائج متميزة في تحرير النص. وقد تحقق من خلاله مستوى دقة للنص يصل إلى 0.688، مما يجعله من بين الأفضل في هذا المجال.

تمثل ViTeX-Bench أساسًا قابلًا لإعادة الإنتاج ويدعم مزيدًا من الدراسات حول التوازنات في تحرير نصوص الفيديو. إن كنت من المهتمين بتقنيات تحرير الفيديو، تابعنا لمزيد من الأخبار المثيرة.