Ailoxa Logo

🏷️ #معايير تقييم

78 مقال

اكتشاف قدرات الذكاء الاصطناعي: LifeAgentBench ثورة في تحليل الصحة الحياتية!
أبحاث

اكتشاف قدرات الذكاء الاصطناعي: LifeAgentBench ثورة في تحليل الصحة الحياتية!

أركايف للذكاءمنذ 1 يوم
WorldBench: معيار ثوري لتعزيز الأداء الثقافي لوكلاء الذكاء الاصطناعي المتعدد اللغات!
أبحاث

WorldBench: معيار ثوري لتعزيز الأداء الثقافي لوكلاء الذكاء الاصطناعي المتعدد اللغات!

أركايف للذكاءمنذ 1 يوم
👁 2
ثورة جديدة في نماذج الذكاء الاصطناعي: تعزيز الثقة من خلال معايير التفكير المتعدد الوسائط
أبحاث

ثورة جديدة في نماذج الذكاء الاصطناعي: تعزيز الثقة من خلال معايير التفكير المتعدد الوسائط

أركايف للذكاءمنذ 2 يوم
FaulT-Bench: معيار جديد لتقييم قدرة وكلاء الذكاء الاصطناعي في تشخيص أعطال الشبكات!
أبحاث

FaulT-Bench: معيار جديد لتقييم قدرة وكلاء الذكاء الاصطناعي في تشخيص أعطال الشبكات!

أركايف للذكاءمنذ 6 يوم
👁 1
TRACE: المعيار الثوري لتقييم سلامة نماذج التفكير الكبيرة!
أبحاث

TRACE: المعيار الثوري لتقييم سلامة نماذج التفكير الكبيرة!

أركايف للذكاءمنذ 8 يوم
👁 1
تجاوز MSE: إعادة التفكير في معايير التقييم واختبارات الأداء لتنبؤات السلاسل الزمنية غير المنتظمة
أبحاث

تجاوز MSE: إعادة التفكير في معايير التقييم واختبارات الأداء لتنبؤات السلاسل الزمنية غير المنتظمة

أركايف للذكاءمنذ 15 يوم
👁 1
نحو تقييم موحد في نمذجة المجالات الآلية: إطلاق معيار ثوري!
أبحاث

نحو تقييم موحد في نمذجة المجالات الآلية: إطلاق معيار ثوري!

أركايف للذكاءمنذ 16 يوم
OODBench: معيار جديد لتقييم نماذج الرؤية واللغة في مواجهة التحديات الواقعية!
أبحاث

OODBench: معيار جديد لتقييم نماذج الرؤية واللغة في مواجهة التحديات الواقعية!

أركايف للذكاءمنذ 16 يوم
تقييم قدرات وكلاء الذكاء الاصطناعي في عمليات الاتصالات: CTBench يتصدر المشهد!
أبحاث

تقييم قدرات وكلاء الذكاء الاصطناعي في عمليات الاتصالات: CTBench يتصدر المشهد!

أركايف للذكاءمنذ 21 يوم
👁 2
ثورة في قياس الذكاء الاصطناعي المالي: FrontierFinance تعيد تعريف المؤشرات!
أبحاث

ثورة في قياس الذكاء الاصطناعي المالي: FrontierFinance تعيد تعريف المؤشرات!

أركايف للذكاءمنذ 21 يوم
👁 1
تحديات جديدة: معايير موحدة لحل المشكلات في تطوير البرمجيات باستخدام الذكاء الاصطناعي!
أبحاث

تحديات جديدة: معايير موحدة لحل المشكلات في تطوير البرمجيات باستخدام الذكاء الاصطناعي!

أركايف للذكاءمنذ 23 يوم
👁 1
اكتشاف آفاق جديدة في الذكاء الاصطناعي: RISE-RL يعيد صياغة التعلم المعزز!
نماذج لغوية

اكتشاف آفاق جديدة في الذكاء الاصطناعي: RISE-RL يعيد صياغة التعلم المعزز!

أركايف للذكاءمنذ 23 يوم
👁 3
تقييم وي يو: معيار ثوري لقياس أداء نماذج اللغة الكبيرة في إدارة النفايات الصلبة!
أبحاث

تقييم وي يو: معيار ثوري لقياس أداء نماذج اللغة الكبيرة في إدارة النفايات الصلبة!

أركايف للذكاءمنذ 23 يوم
👁 2
هل يكشف تقييم النماذج الزمنية الزائفة؟ دعونا نعيد النظر في منهجيات الاختبار!
أبحاث

هل يكشف تقييم النماذج الزمنية الزائفة؟ دعونا نعيد النظر في منهجيات الاختبار!

أركايف للذكاءمنذ 24 يوم
👁 1
ثورة في تقييم الأصالة العلمية: معيار جديد يقود نحو الابتكار
أبحاث

ثورة في تقييم الأصالة العلمية: معيار جديد يقود نحو الابتكار

أركايف للذكاءمنذ 27 يوم
FinReportBench: كيف يمكن لنماذج الذكاء الاصطناعي تحسين تقارير المؤسسات المالية بشكل ثوري؟
أبحاث

FinReportBench: كيف يمكن لنماذج الذكاء الاصطناعي تحسين تقارير المؤسسات المالية بشكل ثوري؟

أركايف للذكاءمنذ 28 يوم
CARE-Bench: ثورة في تقييم نماذج الذكاء الاصطناعي لتشخيص المرضى
أبحاث

CARE-Bench: ثورة في تقييم نماذج الذكاء الاصطناعي لتشخيص المرضى

أركايف للذكاءمنذ 29 يوم
👁 2
ثورة الذكاء الاصطناعي: منصة OmegaUse-OfficeVal تقيّم كفاءة وكلاء نماذج اللغة في مهام المكتب!
أبحاث

ثورة الذكاء الاصطناعي: منصة OmegaUse-OfficeVal تقيّم كفاءة وكلاء نماذج اللغة في مهام المكتب!

أركايف للذكاءمنذ 1 شهر
👁 1
اكتشف GraphRareBench: معيار ثوري لتشخيص الأمراض النادرة بدقة وشفافية
أبحاث

اكتشف GraphRareBench: معيار ثوري لتشخيص الأمراض النادرة بدقة وشفافية

أركايف للذكاءمنذ 1 شهر
ثورة في تقييم الذكاء الاصطناعي: اكتشفوا DFAH-Bench وأثره في اتخاذ القرارات المالية!
أبحاث

ثورة في تقييم الذكاء الاصطناعي: اكتشفوا DFAH-Bench وأثره في اتخاذ القرارات المالية!

أركايف للذكاءمنذ 1 شهر
👁 1