Ailoxa Logo

🏷️ #نماذج متعددة الوسائط

36 مقال

ثورة في توليد الصور: السيطرة على الأفعال الخفية لتحسين الفهم البصري
نماذج لغوية

ثورة في توليد الصور: السيطرة على الأفعال الخفية لتحسين الفهم البصري

أركايف للذكاءمنذ 2 شهر
التحول في الذكاء الاصطناعي: كيف يمكن لـ CAVE تحسين التفكير البصري المعقد؟
أبحاث

التحول في الذكاء الاصطناعي: كيف يمكن لـ CAVE تحسين التفكير البصري المعقد؟

أركايف للذكاءمنذ 2 شهر
اختيار الأدلة البصرية الذكية: الثورة في استرجاع المعلومات متعددة الوسائط
أبحاث

اختيار الأدلة البصرية الذكية: الثورة في استرجاع المعلومات متعددة الوسائط

أركايف للذكاءمنذ 2 شهر
إعادة توجيه توليد المحتوى البصري: كيف يعزز نموذج متعدد الوسائط الفهم والإنتاجية!
أبحاث

إعادة توجيه توليد المحتوى البصري: كيف يعزز نموذج متعدد الوسائط الفهم والإنتاجية!

أركايف للذكاءمنذ 2 شهر
كيف يفهم GPT-4o الرؤية؟ تقييم النماذج متعددة الوسائط في مهام الرؤية الحاسوبية
أبحاث

كيف يفهم GPT-4o الرؤية؟ تقييم النماذج متعددة الوسائط في مهام الرؤية الحاسوبية

أركايف للذكاءمنذ 2 شهر
لغة معمارية مبتكرة لوكلاء بصريين مرونين: كيف يمكن للذكاء الاصطناعي تجاوز التحديات المعمارية؟
أبحاث

لغة معمارية مبتكرة لوكلاء بصريين مرونين: كيف يمكن للذكاء الاصطناعي تجاوز التحديات المعمارية؟

أركايف للذكاءمنذ 2 شهر
أبستريم كيو إيه: إطار عمل مبتكر لتحسين استنتاج الفيديو والإجابة على الأسئلة!
أبحاث

أبستريم كيو إيه: إطار عمل مبتكر لتحسين استنتاج الفيديو والإجابة على الأسئلة!

أركايف للذكاءمنذ 2 شهر
ثورة الصوت: اكتشفوا Audio-Omni - الإطار الشامل لتوليد وتحرير الصوتيات!
أبحاث

ثورة الصوت: اكتشفوا Audio-Omni - الإطار الشامل لتوليد وتحرير الصوتيات!

أركايف للذكاءمنذ 2 شهر
كيفية تعليم نماذج متعددة الوسائط الكبيرة مهارات جديدة دون فقدان القدرات السابقة
أبحاث

كيفية تعليم نماذج متعددة الوسائط الكبيرة مهارات جديدة دون فقدان القدرات السابقة

أركايف للذكاءمنذ 3 شهر
التفكير المتسلسل يعاني من تدهور الذكاء المكاني في النماذج متعددة الوسائط!
أبحاث

التفكير المتسلسل يعاني من تدهور الذكاء المكاني في النماذج متعددة الوسائط!

أركايف للذكاءمنذ 3 شهر
MERRIN: ثورة في استرجاع الأدلة المتعددة الوسائط في بيئات الإنترنت المربكة
أبحاث

MERRIN: ثورة في استرجاع الأدلة المتعددة الوسائط في بيئات الإنترنت المربكة

أركايف للذكاءمنذ 3 شهر
تشارت نت: مجموعة بيانات متعددة الأبعاد بمليون عينة لفهم الرسوم البيانية بفاعلية
أبحاث

تشارت نت: مجموعة بيانات متعددة الأبعاد بمليون عينة لفهم الرسوم البيانية بفاعلية

أركايف للذكاءمنذ 3 شهر
👁 6
فتح آفاق جديدة: كيف تحقق نماذج تحويل الفيديو إلى صوت تطوراً مذهلاً في توليد الصوتيات الطويلة؟
أبحاث

فتح آفاق جديدة: كيف تحقق نماذج تحويل الفيديو إلى صوت تطوراً مذهلاً في توليد الصوتيات الطويلة؟

أركايف للذكاءمنذ 3 شهر
استكشاف عالَم NVIDIA Nemotron 3: مستقبل الذكاء الاصطناعي القادر على التفكير والتفاعل بأمان!
نماذج لغوية

استكشاف عالَم NVIDIA Nemotron 3: مستقبل الذكاء الاصطناعي القادر على التفكير والتفاعل بأمان!

مدونة إنفيديا للذكاءمنذ 3 شهر
تعزيز أنظمة المعرفة بتقنيات الذكاء الاصطناعي: 5 ميزات أساسية لنماذج 'RAG' متعددة الوسائط
أبحاث

تعزيز أنظمة المعرفة بتقنيات الذكاء الاصطناعي: 5 ميزات أساسية لنماذج 'RAG' متعددة الوسائط

مدونة إنفيديا للذكاءمنذ 5 شهر
تعرّف على زمن الذكاء الاصطناعي: ما هي حدود نماذج الفيديو المتعددة الوسائط؟
نماذج لغوية

تعرّف على زمن الذكاء الاصطناعي: ما هي حدود نماذج الفيديو المتعددة الوسائط؟

هاجينج فيسمنذ 12 شهر