Ailoxa Logo

🏷️ #تقييم

379 مقال

اكتشاف آلية جديدة لتقييم موثوقية المطالبات لتعزيز الفهم الذكي في الوقت الحقيقي
أبحاث

اكتشاف آلية جديدة لتقييم موثوقية المطالبات لتعزيز الفهم الذكي في الوقت الحقيقي

أركايف للذكاءمنذ 23 يوم
ثورة جديدة في فهم الصور الجوية: نموذج UAVMA-Bench يحقق دقة غير مسبوقة!
أبحاث

ثورة جديدة في فهم الصور الجوية: نموذج UAVMA-Bench يحقق دقة غير مسبوقة!

أركايف للذكاءمنذ 23 يوم
قفزة نوعية في تقييم الذكاء الاصطناعي: استخدام الرسوم البيانية الهيكلية لتقييمات أكثر دقة!
أبحاث

قفزة نوعية في تقييم الذكاء الاصطناعي: استخدام الرسوم البيانية الهيكلية لتقييمات أكثر دقة!

أركايف للذكاءمنذ 23 يوم
هل يمكن للذكاء الاصطناعي محاكاة العقل البشري؟ اكتشافات جديدة تكشف المستور!
أبحاث

هل يمكن للذكاء الاصطناعي محاكاة العقل البشري؟ اكتشافات جديدة تكشف المستور!

أركايف للذكاءمنذ 23 يوم
👁 1
SPIEval: تقييم فعالية نماذج اللغة الضخمة كمساعدين شخصيين على الهواتف الذكية!
أبحاث

SPIEval: تقييم فعالية نماذج اللغة الضخمة كمساعدين شخصيين على الهواتف الذكية!

أركايف للذكاءمنذ 24 يوم
👁 3
تقدير معلمات العناصر المتعددة باستخدام نموذج لغوي متقدم: ثورة جديدة في نمذجة الاختبارات!
نماذج لغوية

تقدير معلمات العناصر المتعددة باستخدام نموذج لغوي متقدم: ثورة جديدة في نمذجة الاختبارات!

أركايف للذكاءمنذ 24 يوم
👁 1
معيار MateInfoUB: اختبار نماذج اللغة الضخمة في التعليم المتعدد اللغات وبأساليب متعددة!
أبحاث

معيار MateInfoUB: اختبار نماذج اللغة الضخمة في التعليم المتعدد اللغات وبأساليب متعددة!

أركايف للذكاءمنذ 25 يوم
👁 3
دليل جديد لتقييم دقة نماذج العالم المدعومة بالذكاء الاصطناعي مع WorldSimProbe!
أبحاث

دليل جديد لتقييم دقة نماذج العالم المدعومة بالذكاء الاصطناعي مع WorldSimProbe!

أركايف للذكاءمنذ 25 يوم
👁 2
كيف يمكن للافتات البلاغية تغيير نتائج مراجعات الذكاء الاصطناعي؟
أبحاث

كيف يمكن للافتات البلاغية تغيير نتائج مراجعات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 25 يوم
👁 2
أسس ومعايير: تقييم نماذج اللغات الضخمة لاستخدامها الحكومي في هولندا
نماذج لغوية

أسس ومعايير: تقييم نماذج اللغات الضخمة لاستخدامها الحكومي في هولندا

أركايف للذكاءمنذ 25 يوم
👁 1
اكتشاف الفجوة في التعاون: كيف تؤثر النماذج اللغوية على قدرة الوكلاء الذكيين؟
أبحاث

اكتشاف الفجوة في التعاون: كيف تؤثر النماذج اللغوية على قدرة الوكلاء الذكيين؟

أركايف للذكاءمنذ 25 يوم
👁 2
كيف تُغير أداة UniHall العالم: تقييم جديد يُفكك تحديات الذكاء الاصطناعي متعدد الوسائط!
أبحاث

كيف تُغير أداة UniHall العالم: تقييم جديد يُفكك تحديات الذكاء الاصطناعي متعدد الوسائط!

أركايف للذكاءمنذ 25 يوم
👁 1
ثورة في قياس الأعراض: كيف يساهم الذكاء الاصطناعي في تقليل عبء الاستجابة للأعراض قبل الحيض؟
أبحاث

ثورة في قياس الأعراض: كيف يساهم الذكاء الاصطناعي في تقليل عبء الاستجابة للأعراض قبل الحيض؟

أركايف للذكاءمنذ 25 يوم
👁 1
Sci-VBench: معيار مبتكر لتقييم إنتاج الفيديو العلمي القائم على المعرفة والتفكير!
أبحاث

Sci-VBench: معيار مبتكر لتقييم إنتاج الفيديو العلمي القائم على المعرفة والتفكير!

أركايف للذكاءمنذ 25 يوم
👁 2
360CityArena: اختبار جديد ثوري لتقييم قدرات التنقل الحضري للروبوتات في بيئات افتراضية واقعية!
روبوتات

360CityArena: اختبار جديد ثوري لتقييم قدرات التنقل الحضري للروبوتات في بيئات افتراضية واقعية!

أركايف للذكاءمنذ 25 يوم
👁 1
نقل المعرفة في التحقق المدعوم بالذكاء الاصطناعي: إطار جديد لتقييم الأداء
أبحاث

نقل المعرفة في التحقق المدعوم بالذكاء الاصطناعي: إطار جديد لتقييم الأداء

أركايف للذكاءمنذ 25 يوم
👁 1
إعادة تعريف المعايير: تقييم جودة معايير وكلاء المحادثة بذكاء اصطناعي فريد!
أبحاث

إعادة تعريف المعايير: تقييم جودة معايير وكلاء المحادثة بذكاء اصطناعي فريد!

أركايف للذكاءمنذ 29 يوم
👁 1
كيف تؤثر البيانات الملوثة على نماذج اللغة الكبيرة؟ اكتشاف جديد يثير القلق!
أبحاث

كيف تؤثر البيانات الملوثة على نماذج اللغة الكبيرة؟ اكتشاف جديد يثير القلق!

أركايف للذكاءمنذ 1 شهر
👁 1
ثورة جديدة في تقييم تعليقات الشطرنج: كيف يمكن لنماذج الذكاء الاصطناعي تجاوز هفوات الواقع!
أبحاث

ثورة جديدة في تقييم تعليقات الشطرنج: كيف يمكن لنماذج الذكاء الاصطناعي تجاوز هفوات الواقع!

أركايف للذكاءمنذ 1 شهر
👁 1
EduClaw-Bench: ثورة في تقييم قدرات وكلاء التعليم الذكي!
أبحاث

EduClaw-Bench: ثورة في تقييم قدرات وكلاء التعليم الذكي!

أركايف للذكاءمنذ 1 شهر