Ailoxa Logo

🏷️ #تقييم الذكاء الاصطناعي

69 مقال

Sci-Rho: ثورة جديدة في تقييم نماذج الذكاء الاصطناعي لمشكلات STEM عبر اللغات
أبحاث

Sci-Rho: ثورة جديدة في تقييم نماذج الذكاء الاصطناعي لمشكلات STEM عبر اللغات

أركايف للذكاءمنذ 1 شهر
SLMJury: هل يمكن للنماذج اللغوية الصغيرة التحكيم بنفس كفاءة الكبيرة؟
نماذج لغوية

SLMJury: هل يمكن للنماذج اللغوية الصغيرة التحكيم بنفس كفاءة الكبيرة؟

أركايف للذكاءمنذ 1 شهر
TRL-Bench: الثوري في توحيد تقييم نماذج الترميز الجدولي عبر paradigms المختلفة!
أبحاث

TRL-Bench: الثوري في توحيد تقييم نماذج الترميز الجدولي عبر paradigms المختلفة!

أركايف للذكاءمنذ 1 شهر
ثورة في تقييم جودة الذكاء الاصطناعي: استقرار القضاة اللغويين تحت التحديات التفاعلية
أبحاث

ثورة في تقييم جودة الذكاء الاصطناعي: استقرار القضاة اللغويين تحت التحديات التفاعلية

أركايف للذكاءمنذ 1 شهر
👁 1
تحديات انحياز الذكاء الاصطناعي: كيف يؤثر الجغرافيا على التنوع في تقييم النماذج؟
أبحاث

تحديات انحياز الذكاء الاصطناعي: كيف يؤثر الجغرافيا على التنوع في تقييم النماذج؟

أركايف للذكاءمنذ 1 شهر
👁 1
GTBench: المعيار الجديد لتقييم نماذج اللغات الضخمة في مساعدة الأبحاث الرياضية
أبحاث

GTBench: المعيار الجديد لتقييم نماذج اللغات الضخمة في مساعدة الأبحاث الرياضية

أركايف للذكاءمنذ 1 شهر
👁 1
TravelEval: إطار مبتكر لتقييم أدوات التخطيط السفرية المدعومة بالذكاء الاصطناعي
أبحاث

TravelEval: إطار مبتكر لتقييم أدوات التخطيط السفرية المدعومة بالذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
👁 1
كشف النقاب عن تحيز النماذج النموذجية في تقييم الذكاء الاصطناعي!
أبحاث

كشف النقاب عن تحيز النماذج النموذجية في تقييم الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
👁 1
من يقيم التأثيرات الاجتماعية للذكاء الاصطناعي؟ تحليل شامل للفجوات والتغطيات
أبحاث

من يقيم التأثيرات الاجتماعية للذكاء الاصطناعي؟ تحليل شامل للفجوات والتغطيات

أركايف للذكاءمنذ 1 شهر
👁 1
KnowledgeBerg: كشف حدود الذكاء الاصطناعي في استيعاب المعرفة والتفكير التحليلي
أبحاث

KnowledgeBerg: كشف حدود الذكاء الاصطناعي في استيعاب المعرفة والتفكير التحليلي

أركايف للذكاءمنذ 1 شهر
👁 1
WorldCoder-Bench: ثورة في قياس تكوين العوالم ثلاثية الأبعاد المستندة إلى الفيزياء!
أبحاث

WorldCoder-Bench: ثورة في قياس تكوين العوالم ثلاثية الأبعاد المستندة إلى الفيزياء!

أركايف للذكاءمنذ 1 شهر
👁 1
مؤشر AttuneBench: قياس الذكاء العاطفي في النماذج اللغوية الكبرى بطريقة مبتكرة!
أبحاث

مؤشر AttuneBench: قياس الذكاء العاطفي في النماذج اللغوية الكبرى بطريقة مبتكرة!

أركايف للذكاءمنذ 1 شهر
تحديات الذكاء الاصطناعي في البيئات محدودة الموارد: نحو تقييمات أكثر واقعية
أبحاث

تحديات الذكاء الاصطناعي في البيئات محدودة الموارد: نحو تقييمات أكثر واقعية

أركايف للذكاءمنذ 1 شهر
ثورة في تقييمات الذكاء الاصطناعي: اكتشفوا تقنية LURE وتأثيرها المذهل!
أبحاث

ثورة في تقييمات الذكاء الاصطناعي: اكتشفوا تقنية LURE وتأثيرها المذهل!

أركايف للذكاءمنذ 1 شهر
اكتشاف الحلول الجديدة: كيفية تقليل تراجع العناصر في تقييمات الذكاء الاصطناعي
أدوات

اكتشاف الحلول الجديدة: كيفية تقليل تراجع العناصر في تقييمات الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
الأمان المرجعي: ثورة جديدة في تقييمات الذكاء الاصطناعي!
أخلاقيات الذكاء الاصطناعي

الأمان المرجعي: ثورة جديدة في تقييمات الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
تأثير الرسائل المتراكمة: كيف تؤثر المحادثات السابقة على تقييم نماذج اللغة؟
أبحاث

تأثير الرسائل المتراكمة: كيف تؤثر المحادثات السابقة على تقييم نماذج اللغة؟

أركايف للذكاءمنذ 1 شهر
FATHOMS-RAG: إطار تقييم تفكير وملاحظة الأنظمة متعددة الوسائط باستخدام التكنولوجيا المتقدمة
أبحاث

FATHOMS-RAG: إطار تقييم تفكير وملاحظة الأنظمة متعددة الوسائط باستخدام التكنولوجيا المتقدمة

أركايف للذكاءمنذ 1 شهر
التحليل الذكي: ضمانات دقيقة لتقييم وكالات الذكاء الاصطناعي بدون توزيع
أبحاث

التحليل الذكي: ضمانات دقيقة لتقييم وكالات الذكاء الاصطناعي بدون توزيع

أركايف للذكاءمنذ 2 شهر
تقييم الذكاء الاصطناعي المفهومي: ثورة نوعية في قياس الإبداع البشري
أبحاث

تقييم الذكاء الاصطناعي المفهومي: ثورة نوعية في قياس الإبداع البشري

أركايف للذكاءمنذ 2 شهر