🏷️ #تقييم نماذج
15 مقال
أبحاث
مدّ جسور الثقة في نتائج صور الطب: اكتشف إطار MedSegBenchmarker الثوري!
أركايف للذكاءمنذ 3 يوم
👁 1أبحاث
BAITBENCH: كيف يكافح الذكاء الاصطناعي للمخاطر الخفية في التجارب العلمية
أركايف للذكاءمنذ 3 يوم
👁 1أبحاث
إطلاق MGAL: المعايير متعددة اللغات لفهم السياقات الطويلة في الذكاء الاصطناعي
أركايف للذكاءمنذ 11 يوم
👁 1نماذج لغوية
هل تساءلت يومًا كيف تتفاعل نماذج الذكاء الاصطناعي مع مصطلحات اللغة الصينية والإنجليزية؟ اكتشف ChiEngMixBench!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
MathNet: ثورة جديدة في تحديات التفكير الرياضي عبر نموذج متعدد الأنماط!
أركايف للذكاءمنذ 1 شهر
👁 1أدوات
تحولات مبهرة في توليد جداول البيانات باستخدام نماذج اللغة العملاقة!
أركايف للذكاءمنذ 1 شهر
أبحاث
تغيير جذري في تقييم نمذجة اللغة: نحو تسلسل سلوكي يتوافق مع الزمن!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
نموذج BeyondArena: ثورة جديدة في تقييم نماذج البيانات الجدولية!
أركايف للذكاءمنذ 2 شهر
أدوات
اكتشفوا أول منصة تقييم شاملة لتطوير نماذج الذكاء الاصطناعي - Olmo-Eval!
هاجينج فيسمنذ 2 شهر
أبحاث
فيستا هوب: ثورة جديدة في تقييم الذكاء البصري للبحث العميق
أركايف للذكاءمنذ 3 شهر
👁 1أبحاث
خطوة نحو النجاح: لماذا يعد استخدام معيار عشوائي أساسياً في اختيار الميزات غير المُراقب؟
أركايف للذكاءمنذ 3 شهر
أبحاث
ثورة في تقييم نماذج الفيديو: إطار رقمي لرصد التناسق الهندسي
أركايف للذكاءمنذ 3 شهر
أبحاث
كيف تعمل نماذج الرؤية-language-action (VLAs) في بيئات العالم المفتوح؟
أركايف للذكاءمنذ 4 شهر
أدوات
SQLyzr: المنصة الشاملة لتقييم نماذج تحويل النص إلى SQL!
أركايف للذكاءمنذ 4 شهر
أبحاث
من المشاعر إلى المقاييس: فهم كيفية تقييم نماذج اللغات الضخمة بشكل فعّال
أركايف للذكاءمنذ 4 شهر
