Ailoxa Logo

🏷️ #تقييم

379 مقال

ابتكار المعايير التفاعلية: لقياس الذكاء الاصطناعي بطريقة جديدة ومذهلة
أبحاث

ابتكار المعايير التفاعلية: لقياس الذكاء الاصطناعي بطريقة جديدة ومذهلة

أركايف للذكاءمنذ 3 شهر
👁 1
ProactBench: ثورة في تقييم الذكاء الاصطناعي من خلال التحفيز التفاعلي!
أبحاث

ProactBench: ثورة في تقييم الذكاء الاصطناعي من خلال التحفيز التفاعلي!

أركايف للذكاءمنذ 3 شهر
👁 1
SGC-RML: تقييم موثوق وشامل لمرض باركنسون باستخدام تقنيات حديثة
أبحاث

SGC-RML: تقييم موثوق وشامل لمرض باركنسون باستخدام تقنيات حديثة

أركايف للذكاءمنذ 3 شهر
👁 1
الذكاء الاصطناعي في الأبحاث: فائدة في الاستكشاف ومخاطر في الدقة!
أبحاث

الذكاء الاصطناعي في الأبحاث: فائدة في الاستكشاف ومخاطر في الدقة!

أركايف للذكاءمنذ 3 شهر
👁 1
طرق مبتكرة لتقدير التصنيفات: شروط تطبيق منهجية التقييم الحُكمية
أبحاث

طرق مبتكرة لتقدير التصنيفات: شروط تطبيق منهجية التقييم الحُكمية

أركايف للذكاءمنذ 3 شهر
👁 1
DRIP-R: معيار مبتكر لتقييم اتخاذ القرارات تحت غموض السياسات في مجال التجزئة!
أبحاث

DRIP-R: معيار مبتكر لتقييم اتخاذ القرارات تحت غموض السياسات في مجال التجزئة!

أركايف للذكاءمنذ 3 شهر
👁 3
البحث الجديد يكشف خفايا ضريبة الترجمة في التقييمات متعددة اللغات: إمكانيات غير متوقعة!
أبحاث

البحث الجديد يكشف خفايا ضريبة الترجمة في التقييمات متعددة اللغات: إمكانيات غير متوقعة!

أركايف للذكاءمنذ 3 شهر
👁 1
إطار عمل مبتكر لتقييم نماذج اللغات الضخمة: دقة وسرعة بلا حدود!
أبحاث

إطار عمل مبتكر لتقييم نماذج اللغات الضخمة: دقة وسرعة بلا حدود!

أركايف للذكاءمنذ 3 شهر
👁 1
ثورة التعلم المعزز: كيف تُحسن المعايير المهيكلة من نتائج الذكاء الاصطناعي
أبحاث

ثورة التعلم المعزز: كيف تُحسن المعايير المهيكلة من نتائج الذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر
اختبار أداء الوكلاء: AgentEscapeBench يكشف تحديات التفكير المستند إلى الأدوات في نماذج اللغة
أبحاث

اختبار أداء الوكلاء: AgentEscapeBench يكشف تحديات التفكير المستند إلى الأدوات في نماذج اللغة

أركايف للذكاءمنذ 3 شهر
ثورة في تدقيق أنظمة الذكاء الاصطناعي: ضمانات جديدة وآمنة
أبحاث

ثورة في تدقيق أنظمة الذكاء الاصطناعي: ضمانات جديدة وآمنة

أركايف للذكاءمنذ 3 شهر
👁 1
اختبار نماذج العالم: ثورة في تقييم الذكاء الاصطناعي بطرق جديدة!
أبحاث

اختبار نماذج العالم: ثورة في تقييم الذكاء الاصطناعي بطرق جديدة!

أركايف للذكاءمنذ 3 شهر
👁 1
ثورة التصميم: تقييم نماذج Text-to-CAD بكل سهولة وفاعلية!
أبحاث

ثورة التصميم: تقييم نماذج Text-to-CAD بكل سهولة وفاعلية!

أركايف للذكاءمنذ 3 شهر
👁 1
تحقيق الدقة في الاستنتاجات متعددة الوسائط: نموذج MuRGAt لنماذج اللغة القوية
أبحاث

تحقيق الدقة في الاستنتاجات متعددة الوسائط: نموذج MuRGAt لنماذج اللغة القوية

أركايف للذكاءمنذ 4 شهر
تحدي تقييم أمان نماذج اللغة: كيف يمكن مقارنة النماذج بدون مؤشرات معيارية؟
أبحاث

تحدي تقييم أمان نماذج اللغة: كيف يمكن مقارنة النماذج بدون مؤشرات معيارية؟

أركايف للذكاءمنذ 4 شهر
👁 1
ثورة التفكير النقدي: كيف يقيم الذكاء الاصطناعي والحكم البشري الحجج المضادة؟
أبحاث

ثورة التفكير النقدي: كيف يقيم الذكاء الاصطناعي والحكم البشري الحجج المضادة؟

أركايف للذكاءمنذ 4 شهر
👁 1
SCRuB: ثورة في تقييم تفكير النماذج اللغوية حول المفاهيم الاجتماعية
أبحاث

SCRuB: ثورة في تقييم تفكير النماذج اللغوية حول المفاهيم الاجتماعية

أركايف للذكاءمنذ 4 شهر
👁 1
تجاوز المعايير الثابتة: تقييم حدود ديناميكي لنماذج اللغة لتحسين القدرات
أبحاث

تجاوز المعايير الثابتة: تقييم حدود ديناميكي لنماذج اللغة لتحسين القدرات

أركايف للذكاءمنذ 4 شهر
AirQualityBench: معيار تقييم واقعي للforecasting جودة الهواء العالمية!
أبحاث

AirQualityBench: معيار تقييم واقعي للforecasting جودة الهواء العالمية!

أركايف للذكاءمنذ 4 شهر
iWorld-Bench: المنصة الثورية لتقييم نماذج العالم التفاعلية في الذكاء الاصطناعي!
أبحاث

iWorld-Bench: المنصة الثورية لتقييم نماذج العالم التفاعلية في الذكاء الاصطناعي!

أركايف للذكاءمنذ 4 شهر
👁 1