🏷️ #تقييم
379 مقال
أبحاث
اكتشاف آلية جديدة لتقييم موثوقية المطالبات لتعزيز الفهم الذكي في الوقت الحقيقي
أركايف للذكاءمنذ 23 يوم
أبحاث
ثورة جديدة في فهم الصور الجوية: نموذج UAVMA-Bench يحقق دقة غير مسبوقة!
أركايف للذكاءمنذ 23 يوم
أبحاث
قفزة نوعية في تقييم الذكاء الاصطناعي: استخدام الرسوم البيانية الهيكلية لتقييمات أكثر دقة!
أركايف للذكاءمنذ 23 يوم
أبحاث
هل يمكن للذكاء الاصطناعي محاكاة العقل البشري؟ اكتشافات جديدة تكشف المستور!
أركايف للذكاءمنذ 23 يوم
👁 1أبحاث
SPIEval: تقييم فعالية نماذج اللغة الضخمة كمساعدين شخصيين على الهواتف الذكية!
أركايف للذكاءمنذ 24 يوم
👁 3نماذج لغوية
تقدير معلمات العناصر المتعددة باستخدام نموذج لغوي متقدم: ثورة جديدة في نمذجة الاختبارات!
أركايف للذكاءمنذ 24 يوم
👁 1أبحاث
معيار MateInfoUB: اختبار نماذج اللغة الضخمة في التعليم المتعدد اللغات وبأساليب متعددة!
أركايف للذكاءمنذ 25 يوم
👁 3أبحاث
دليل جديد لتقييم دقة نماذج العالم المدعومة بالذكاء الاصطناعي مع WorldSimProbe!
أركايف للذكاءمنذ 25 يوم
👁 2أبحاث
كيف يمكن للافتات البلاغية تغيير نتائج مراجعات الذكاء الاصطناعي؟
أركايف للذكاءمنذ 25 يوم
👁 2نماذج لغوية
أسس ومعايير: تقييم نماذج اللغات الضخمة لاستخدامها الحكومي في هولندا
أركايف للذكاءمنذ 25 يوم
👁 1أبحاث
اكتشاف الفجوة في التعاون: كيف تؤثر النماذج اللغوية على قدرة الوكلاء الذكيين؟
أركايف للذكاءمنذ 25 يوم
👁 2أبحاث
كيف تُغير أداة UniHall العالم: تقييم جديد يُفكك تحديات الذكاء الاصطناعي متعدد الوسائط!
أركايف للذكاءمنذ 25 يوم
👁 1أبحاث
ثورة في قياس الأعراض: كيف يساهم الذكاء الاصطناعي في تقليل عبء الاستجابة للأعراض قبل الحيض؟
أركايف للذكاءمنذ 25 يوم
👁 1أبحاث
Sci-VBench: معيار مبتكر لتقييم إنتاج الفيديو العلمي القائم على المعرفة والتفكير!
أركايف للذكاءمنذ 25 يوم
👁 2روبوتات
360CityArena: اختبار جديد ثوري لتقييم قدرات التنقل الحضري للروبوتات في بيئات افتراضية واقعية!
أركايف للذكاءمنذ 25 يوم
👁 1أبحاث
نقل المعرفة في التحقق المدعوم بالذكاء الاصطناعي: إطار جديد لتقييم الأداء
أركايف للذكاءمنذ 25 يوم
👁 1أبحاث
إعادة تعريف المعايير: تقييم جودة معايير وكلاء المحادثة بذكاء اصطناعي فريد!
أركايف للذكاءمنذ 29 يوم
👁 1أبحاث
كيف تؤثر البيانات الملوثة على نماذج اللغة الكبيرة؟ اكتشاف جديد يثير القلق!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
ثورة جديدة في تقييم تعليقات الشطرنج: كيف يمكن لنماذج الذكاء الاصطناعي تجاوز هفوات الواقع!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
EduClaw-Bench: ثورة في تقييم قدرات وكلاء التعليم الذكي!
أركايف للذكاءمنذ 1 شهر
