Ailoxa Logo

🏷️ #فهم الفيديو

33 مقال

جوجل تُحدث ثورة في فهم الفيديو مع نماذج جيميني: تخفيض استخدام التوكنز بنسبة تصل إلى 88%! 🚀
أبحاث

جوجل تُحدث ثورة في فهم الفيديو مع نماذج جيميني: تخفيض استخدام التوكنز بنسبة تصل إلى 88%! 🚀

مارك تيك بوستمنذ 8 يوم
👁 2
OVIBench: الثورة في تقييم الذكاء الاصطناعي لفهم الفيديو تحت ظروف مقاطعة حقيقية!
أبحاث

OVIBench: الثورة في تقييم الذكاء الاصطناعي لفهم الفيديو تحت ظروف مقاطعة حقيقية!

أركايف للذكاءمنذ 19 يوم
👁 3
ReynoldsFlow: تمثيل ديناميكي ثوري لفهم الفيديو مستوحى من الفيزياء
أبحاث

ReynoldsFlow: تمثيل ديناميكي ثوري لفهم الفيديو مستوحى من الفيزياء

أركايف للذكاءمنذ 23 يوم
👁 1
إحداث ثورة في فهم الفيديو: EgoGazeLite يجلب تقنية توقع النظر إلى الأجهزة المحمولة!
نماذج لغوية

إحداث ثورة في فهم الفيديو: EgoGazeLite يجلب تقنية توقع النظر إلى الأجهزة المحمولة!

أركايف للذكاءمنذ 26 يوم
👁 1
إطلاق EgoMonth: معيار الفيديوهات الشخصية لتحسين الذاكرة الزمكانية طويلة الأمد!
أبحاث

إطلاق EgoMonth: معيار الفيديوهات الشخصية لتحسين الذاكرة الزمكانية طويلة الأمد!

أركايف للذكاءمنذ 1 شهر
👁 1
تحدي EgoCross: انطلاقة جديدة في فهم الفيديوهات من منظور أول بأحدث ما توصلت إليه التكنولوجيا!
أبحاث

تحدي EgoCross: انطلاقة جديدة في فهم الفيديوهات من منظور أول بأحدث ما توصلت إليه التكنولوجيا!

أركايف للذكاءمنذ 1 شهر
👁 1
CADER: الثقة الديناميكية في استنتاج الأدلة لفهم الفيديوهات الطويلة
أبحاث

CADER: الثقة الديناميكية في استنتاج الأدلة لفهم الفيديوهات الطويلة

أركايف للذكاءمنذ 1 شهر
👁 2
إطلاق MoD-VLLM: ثورة في فهم الفيديوهات الطويلة متعددة الفعاليات!
نماذج لغوية

إطلاق MoD-VLLM: ثورة في فهم الفيديوهات الطويلة متعددة الفعاليات!

أركايف للذكاءمنذ 1 شهر
👁 3
اكتشاف الأفعال ونتائجها: ثورة جديدة في فهم الفيديوهات!
أبحاث

اكتشاف الأفعال ونتائجها: ثورة جديدة في فهم الفيديوهات!

أركايف للذكاءمنذ 2 شهر
👁 3
ثورة في فهم الفيديو: كيف ستغير خوارزمية TASKER المشهد في الذكاء الاصطناعي!
أبحاث

ثورة في فهم الفيديو: كيف ستغير خوارزمية TASKER المشهد في الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
👁 1
اكتشف كيف يستطيع Reflect-R1 تغيير فهمنا للفيديوهات الطويلة!
أبحاث

اكتشف كيف يستطيع Reflect-R1 تغيير فهمنا للفيديوهات الطويلة!

أركايف للذكاءمنذ 2 شهر
نظام قوي لفهم الفيديو يعتمد على الثقة: ثورة في تحليل الفيديو!
أبحاث

نظام قوي لفهم الفيديو يعتمد على الثقة: ثورة في تحليل الفيديو!

أركايف للذكاءمنذ 2 شهر
👁 2
LiveStarPro: ثورة جديدة في فهم الفيديوهات عبر البث المباشر بفضل الذاكرة الهيكلية!
أبحاث

LiveStarPro: ثورة جديدة في فهم الفيديوهات عبر البث المباشر بفضل الذاكرة الهيكلية!

أركايف للذكاءمنذ 2 شهر
ثورة في فهم الفيديو المتدفق: كيف يمكن لنموذج SelectStream تحسين ذاكرة الفيديو؟
أبحاث

ثورة في فهم الفيديو المتدفق: كيف يمكن لنموذج SelectStream تحسين ذاكرة الفيديو؟

أركايف للذكاءمنذ 2 شهر
ReFoCUS: ثورة جديدة في تحسين فهم الفيديو باستخدام الذكاء الاصطناعي!
أبحاث

ReFoCUS: ثورة جديدة في تحسين فهم الفيديو باستخدام الذكاء الاصطناعي!

أركايف للذكاءمنذ 3 شهر
موس-فيديو: فهم الفيديو في الوقت الحقيقي باستخدام تقنيات الانتباه المتداخل
أبحاث

موس-فيديو: فهم الفيديو في الوقت الحقيقي باستخدام تقنيات الانتباه المتداخل

أركايف للذكاءمنذ 3 شهر
عندما تكون الإجابات مفقودة: كشف عجز نماذج الذكاء الاصطناعي في فهم الفيديو
أبحاث

عندما تكون الإجابات مفقودة: كشف عجز نماذج الذكاء الاصطناعي في فهم الفيديو

أركايف للذكاءمنذ 3 شهر
👁 1
كيف تشكل البيانات نماذج الفيديو: رحلة مثيرة عبر فهم الفيديو
أبحاث

كيف تشكل البيانات نماذج الفيديو: رحلة مثيرة عبر فهم الفيديو

أركايف للذكاءمنذ 3 شهر
فهم الفيديوهات باستخدام نماذج اللغات الضخمة: رؤية إنسانية مثيرة للابتكار
أبحاث

فهم الفيديوهات باستخدام نماذج اللغات الضخمة: رؤية إنسانية مثيرة للابتكار

أركايف للذكاءمنذ 3 شهر
الإبداع بلا حدود: تعرفوا على StreamingVLM لفهم دقيق وفوري لتيارات الفيديو اللانهائية!
أبحاث

الإبداع بلا حدود: تعرفوا على StreamingVLM لفهم دقيق وفوري لتيارات الفيديو اللانهائية!

أركايف للذكاءمنذ 3 شهر
👁 2