Ailoxa Logo

🏷️ #فيديو

46 مقال

اكتشف القوة الجديدة: MotionEnhancer يغير قواعد اللعبة في نماذج الرؤية واللغة مع تحسين الحركة!
أبحاث

اكتشف القوة الجديدة: MotionEnhancer يغير قواعد اللعبة في نماذج الرؤية واللغة مع تحسين الحركة!

أركايف للذكاءمنذ 1 شهر
ثورة الذاكرة المكانية: الكشف عن LongSpace لتحسين فهم الفيديوهات الطويلة!
أبحاث

ثورة الذاكرة المكانية: الكشف عن LongSpace لتحسين فهم الفيديوهات الطويلة!

أركايف للذكاءمنذ 1 شهر
نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري
أخلاقيات الذكاء الاصطناعي

نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري

أركايف للذكاءمنذ 1 شهر
👁 1
v-HUB: معيار جديد لفهم الفكاهة في الفيديوهات من خلال الرؤية والصوت
أبحاث

v-HUB: معيار جديد لفهم الفكاهة في الفيديوهات من خلال الرؤية والصوت

أركايف للذكاءمنذ 1 شهر
هل يمكن للذكاء الاصطناعي تغيير كيفية إنشاء الفيديوهات؟ اكتشاف إطار Real2SAM2Real المبتكر!
أبحاث

هل يمكن للذكاء الاصطناعي تغيير كيفية إنشاء الفيديوهات؟ اكتشاف إطار Real2SAM2Real المبتكر!

أركايف للذكاءمنذ 1 شهر
👁 1
V-LynX: ثورة في دمج الفيديو مع النماذج اللغوية الضخمة!
أبحاث

V-LynX: ثورة في دمج الفيديو مع النماذج اللغوية الضخمة!

أركايف للذكاءمنذ 1 شهر
👁 1
استكشاف دقة اللحظات: تقييم نماذج اللغة متعددة الوسائط في فهم الفيديو
أبحاث

استكشاف دقة اللحظات: تقييم نماذج اللغة متعددة الوسائط في فهم الفيديو

أركايف للذكاءمنذ 1 شهر
👁 1
إعادة تصور أساسيات الفيديو الزمني من منظور الألعاب: الابتكارات في التعلم الخاضع للإشراف الضعيف
أبحاث

إعادة تصور أساسيات الفيديو الزمني من منظور الألعاب: الابتكارات في التعلم الخاضع للإشراف الضعيف

أركايف للذكاءمنذ 1 شهر
اكتشاف الفيديو المستقبلي: كيف يُحول VideoTemp-o3 فهم الفيديو إلى تجربة تفاعلية مذهلة!
أبحاث

اكتشاف الفيديو المستقبلي: كيف يُحول VideoTemp-o3 فهم الفيديو إلى تجربة تفاعلية مذهلة!

أركايف للذكاءمنذ 1 شهر
ثورة في كشف الانحرافات الفيديو: إطار CoReVAD للتفكير السياقي بدون تدريب
أبحاث

ثورة في كشف الانحرافات الفيديو: إطار CoReVAD للتفكير السياقي بدون تدريب

أركايف للذكاءمنذ 1 شهر
جوجل تدخل عالم الفيديو: نموذج Gemini Omni يحول النصوص والصور والصوت إلى فيديوهات بسهولة مذهلة!
نماذج لغوية

جوجل تدخل عالم الفيديو: نموذج Gemini Omni يحول النصوص والصور والصوت إلى فيديوهات بسهولة مذهلة!

تيك كرانشمنذ 2 شهر
كيف تُغير فيديوهات الويب مستقبل الذكاء الاصطناعي: اكتشاف ميزة VideoDR الجديدة!
أبحاث

كيف تُغير فيديوهات الويب مستقبل الذكاء الاصطناعي: اكتشاف ميزة VideoDR الجديدة!

أركايف للذكاءمنذ 2 شهر
ثورة جديدة في إنتاج الفيديو: تحسين دقة NVIDIA Cosmos Predict 2.5 باستخدام LoRA/DoRA!
روبوتات

ثورة جديدة في إنتاج الفيديو: تحسين دقة NVIDIA Cosmos Predict 2.5 باستخدام LoRA/DoRA!

هاجينج فيسمنذ 2 شهر
هل يمكن لنماذج الفيديو الخفية أن تُحدث ثورة في عالم الذكاء الاصطناعي؟
أبحاث

هل يمكن لنماذج الفيديو الخفية أن تُحدث ثورة في عالم الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
NVIDIA تطلق SANA-WM: نموذج عالمي مفتوح المصدر يولد فيديوهات دقيقة بدقة 720p باستخدام GPU واحد!
أبحاث

NVIDIA تطلق SANA-WM: نموذج عالمي مفتوح المصدر يولد فيديوهات دقيقة بدقة 720p باستخدام GPU واحد!

مارك تيك بوستمنذ 2 شهر
👁 2
رانواي: كيف تسعى للسيطرة على عالم الذكاء الاصطناعي وتحدي عمالقة مثل جوجل!
شركات

رانواي: كيف تسعى للسيطرة على عالم الذكاء الاصطناعي وتحدي عمالقة مثل جوجل!

تيك كرانشمنذ 2 شهر
👁 1
VDCook: النظام الثوري لبناء بيانات الفيديو لفائدة الذكاء الاصطناعي!
أبحاث

VDCook: النظام الثوري لبناء بيانات الفيديو لفائدة الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة في عالم الفيديو: MV-S2V لتوليد الفيديوهات متعددة الزوايا باحترافية!
أبحاث

ثورة في عالم الفيديو: MV-S2V لتوليد الفيديوهات متعددة الزوايا باحترافية!

أركايف للذكاءمنذ 2 شهر
فيديوGPA: ثورة جديدة في توليد الفيديوهات الثلاثية الأبعاد مع الحفاظ على الثبات الهندسي!
أبحاث

فيديوGPA: ثورة جديدة في توليد الفيديوهات الثلاثية الأبعاد مع الحفاظ على الثبات الهندسي!

أركايف للذكاءمنذ 2 شهر
موسيقى ورقص: ثورة جديدة في إنتاج الفيديو مع MusicInfuser!
أدوات

موسيقى ورقص: ثورة جديدة في إنتاج الفيديو مع MusicInfuser!

أركايف للذكاءمنذ 2 شهر