Ailoxa Logo

🏷️ #MLLMs

65 مقال

تحول الصورة: كيف يعزز CVSearch الذكاء البصري لنماذج اللغة متعددة الوسائط!
أبحاث

تحول الصورة: كيف يعزز CVSearch الذكاء البصري لنماذج اللغة متعددة الوسائط!

أركايف للذكاءمنذ 1 شهر
تحسين الفهم البصري في نماذج اللغة متعددة الوسائط عبر المهام المتولدة تقنيًا
أبحاث

تحسين الفهم البصري في نماذج اللغة متعددة الوسائط عبر المهام المتولدة تقنيًا

أركايف للذكاءمنذ 1 شهر
تحديث المعرفة في الذكاء الاصطناعي: التحسينات الثورية لنماذج البيانات متعددة الوسائط
أبحاث

تحديث المعرفة في الذكاء الاصطناعي: التحسينات الثورية لنماذج البيانات متعددة الوسائط

أركايف للذكاءمنذ 1 شهر
نحو فهم أعمق: كيف يؤثر ضعف الإدراك على أداء نماذج اللغات المتعددة الوسائط؟
أبحاث

نحو فهم أعمق: كيف يؤثر ضعف الإدراك على أداء نماذج اللغات المتعددة الوسائط؟

أركايف للذكاءمنذ 2 شهر
👁 1
ابتكار ثوري: محرر متميز لتعديل نماذج اللغة متعددة الوسائط!
نماذج لغوية

ابتكار ثوري: محرر متميز لتعديل نماذج اللغة متعددة الوسائط!

أركايف للذكاءمنذ 2 شهر
إطلاق العنان للذكاء الاصطناعي: إطار مبتكر لاختراق نماذج اللغة متعددة الوسائط باستخدام صور متعددة!
أبحاث

إطلاق العنان للذكاء الاصطناعي: إطار مبتكر لاختراق نماذج اللغة متعددة الوسائط باستخدام صور متعددة!

أركايف للذكاءمنذ 2 شهر
HiDe: إعادة التفكير في أسلوب التكبير في نماذج اللغات متعددة الوسائط العالية الدقة
أبحاث

HiDe: إعادة التفكير في أسلوب التكبير في نماذج اللغات متعددة الوسائط العالية الدقة

أركايف للذكاءمنذ 2 شهر
كيف تؤثر رؤوس الانتباه في توازن الهلوسة الناتجة عن تعارض الحواس؟
أبحاث

كيف تؤثر رؤوس الانتباه في توازن الهلوسة الناتجة عن تعارض الحواس؟

أركايف للذكاءمنذ 2 شهر
👁 1
ESI-Bench: خطوة جديدة نحو الذكاء المكاني المدمج الذي يغلق حلقة الإدراك-الفعل!
أبحاث

ESI-Bench: خطوة جديدة نحو الذكاء المكاني المدمج الذي يغلق حلقة الإدراك-الفعل!

أركايف للذكاءمنذ 2 شهر
تجاوز الحدود: تقنية Vision-OPD ترفع مستوى الفهم البصري في نماذج الذكاء الاصطناعي متعددة الوسائط!
أبحاث

تجاوز الحدود: تقنية Vision-OPD ترفع مستوى الفهم البصري في نماذج الذكاء الاصطناعي متعددة الوسائط!

أركايف للذكاءمنذ 2 شهر
تعزيز كفاءة تدريب نماذج اللغات متعددة الوسائط من خلال تكييف الكثافة التدريبية!
أبحاث

تعزيز كفاءة تدريب نماذج اللغات متعددة الوسائط من خلال تكييف الكثافة التدريبية!

أركايف للذكاءمنذ 2 شهر
قناة المنطق الصريح: خطوة جديدة في تعزيز نماذج اللغات الكبيرة متعددة الوسائط
أبحاث

قناة المنطق الصريح: خطوة جديدة في تعزيز نماذج اللغات الكبيرة متعددة الوسائط

أركايف للذكاءمنذ 2 شهر
ثغرات خطيرة: كيف تؤدي تدهور جودة الصورة إلى تخطي أمان نماذج اللغات المرئية!
أبحاث

ثغرات خطيرة: كيف تؤدي تدهور جودة الصورة إلى تخطي أمان نماذج اللغات المرئية!

أركايف للذكاءمنذ 2 شهر
كشف أسرار Qwen3-VL-Seg: ثورة في تقسيم المشاهد الناطقة بالعالم المفتوح!

كشف أسرار Qwen3-VL-Seg: ثورة في تقسيم المشاهد الناطقة بالعالم المفتوح!

أركايف للذكاءمنذ 2 شهر
سبايسال بينش: ثورة في تقييم نماذج الذكاء الاصطناعي متعددة الوسائط في إدراك الفضاء!
أبحاث

سبايسال بينش: ثورة في تقييم نماذج الذكاء الاصطناعي متعددة الوسائط في إدراك الفضاء!

أركايف للذكاءمنذ 2 شهر
👁 1
استكشاف الآليات الداخلية لنماذج اللغات متعددة الوسائط: كيف نفهم التصورات البصرية؟
أبحاث

استكشاف الآليات الداخلية لنماذج اللغات متعددة الوسائط: كيف نفهم التصورات البصرية؟

أركايف للذكاءمنذ 2 شهر
SIV-Bench: المعيار الثوري لتقييم فهم التفاعلات الاجتماعية بين الإنسان والآلة
أبحاث

SIV-Bench: المعيار الثوري لتقييم فهم التفاعلات الاجتماعية بين الإنسان والآلة

أركايف للذكاءمنذ 2 شهر
تحويل الذكاء الاصطناعي: كيف يساهم نموذج Fine-R1 في تحسين التعرف الدقيق على الصور!
أبحاث

تحويل الذكاء الاصطناعي: كيف يساهم نموذج Fine-R1 في تحسين التعرف الدقيق على الصور!

أركايف للذكاءمنذ 2 شهر
EmoTrans: معيار جديد لفهم وتحليل التحولات العاطفية في نماذج اللغة متعددة الأبعاد
أبحاث

EmoTrans: معيار جديد لفهم وتحليل التحولات العاطفية في نماذج اللغة متعددة الأبعاد

أركايف للذكاءمنذ 2 شهر
ثورة في فهم الصور المتعددة: CGC يعيد تشكيل الذكاء الاصطناعي!
أبحاث

ثورة في فهم الصور المتعددة: CGC يعيد تشكيل الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
👁 1