Ailoxa Logo

🏷️ #تقييم نماذج

15 مقال

مدّ جسور الثقة في نتائج صور الطب: اكتشف إطار MedSegBenchmarker الثوري!
أبحاث

مدّ جسور الثقة في نتائج صور الطب: اكتشف إطار MedSegBenchmarker الثوري!

أركايف للذكاءمنذ 3 يوم
👁 1
BAITBENCH: كيف يكافح الذكاء الاصطناعي للمخاطر الخفية في التجارب العلمية
أبحاث

BAITBENCH: كيف يكافح الذكاء الاصطناعي للمخاطر الخفية في التجارب العلمية

أركايف للذكاءمنذ 3 يوم
👁 1
إطلاق MGAL: المعايير متعددة اللغات لفهم السياقات الطويلة في الذكاء الاصطناعي
أبحاث

إطلاق MGAL: المعايير متعددة اللغات لفهم السياقات الطويلة في الذكاء الاصطناعي

أركايف للذكاءمنذ 11 يوم
👁 1
هل تساءلت يومًا كيف تتفاعل نماذج الذكاء الاصطناعي مع مصطلحات اللغة الصينية والإنجليزية؟ اكتشف ChiEngMixBench!
نماذج لغوية

هل تساءلت يومًا كيف تتفاعل نماذج الذكاء الاصطناعي مع مصطلحات اللغة الصينية والإنجليزية؟ اكتشف ChiEngMixBench!

أركايف للذكاءمنذ 1 شهر
👁 1
MathNet: ثورة جديدة في تحديات التفكير الرياضي عبر نموذج متعدد الأنماط!
أبحاث

MathNet: ثورة جديدة في تحديات التفكير الرياضي عبر نموذج متعدد الأنماط!

أركايف للذكاءمنذ 1 شهر
👁 1
تحولات مبهرة في توليد جداول البيانات باستخدام نماذج اللغة العملاقة!
أدوات

تحولات مبهرة في توليد جداول البيانات باستخدام نماذج اللغة العملاقة!

أركايف للذكاءمنذ 1 شهر
تغيير جذري في تقييم نمذجة اللغة: نحو تسلسل سلوكي يتوافق مع الزمن!
أبحاث

تغيير جذري في تقييم نمذجة اللغة: نحو تسلسل سلوكي يتوافق مع الزمن!

أركايف للذكاءمنذ 2 شهر
👁 1
نموذج BeyondArena: ثورة جديدة في تقييم نماذج البيانات الجدولية!
أبحاث

نموذج BeyondArena: ثورة جديدة في تقييم نماذج البيانات الجدولية!

أركايف للذكاءمنذ 2 شهر
اكتشفوا أول منصة تقييم شاملة لتطوير نماذج الذكاء الاصطناعي - Olmo-Eval!
أدوات

اكتشفوا أول منصة تقييم شاملة لتطوير نماذج الذكاء الاصطناعي - Olmo-Eval!

هاجينج فيسمنذ 2 شهر
فيستا هوب: ثورة جديدة في تقييم الذكاء البصري للبحث العميق
أبحاث

فيستا هوب: ثورة جديدة في تقييم الذكاء البصري للبحث العميق

أركايف للذكاءمنذ 3 شهر
👁 1
خطوة نحو النجاح: لماذا يعد استخدام معيار عشوائي أساسياً في اختيار الميزات غير المُراقب؟
أبحاث

خطوة نحو النجاح: لماذا يعد استخدام معيار عشوائي أساسياً في اختيار الميزات غير المُراقب؟

أركايف للذكاءمنذ 3 شهر
ثورة في تقييم نماذج الفيديو: إطار رقمي لرصد التناسق الهندسي
أبحاث

ثورة في تقييم نماذج الفيديو: إطار رقمي لرصد التناسق الهندسي

أركايف للذكاءمنذ 3 شهر
كيف تعمل نماذج الرؤية-language-action (VLAs) في بيئات العالم المفتوح؟
أبحاث

كيف تعمل نماذج الرؤية-language-action (VLAs) في بيئات العالم المفتوح؟

أركايف للذكاءمنذ 4 شهر
SQLyzr: المنصة الشاملة لتقييم نماذج تحويل النص إلى SQL!
أدوات

SQLyzr: المنصة الشاملة لتقييم نماذج تحويل النص إلى SQL!

أركايف للذكاءمنذ 4 شهر
من المشاعر إلى المقاييس: فهم كيفية تقييم نماذج اللغات الضخمة بشكل فعّال
أبحاث

من المشاعر إلى المقاييس: فهم كيفية تقييم نماذج اللغات الضخمة بشكل فعّال

أركايف للذكاءمنذ 4 شهر