🏷️ #تقييم
379 مقال
أبحاث
تحسين نتائج التعليم: تقييم جماعي لمهارات حل المشكلات باستخدام الذكاء الاصطناعي
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
كيف يسخر الذكاء الاصطناعي من الفكاهة متعددة الوسائط؟ اكتشفوا التحديات والإمكانيات!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
Relay-Bench: ثورة في تقييم نماذج الذكاء الاصطناعي عبر تحديات متعددة المجالات!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
مستقبل التشخيص الطبي: MedDDC-Eval يكشف عن تقييم جديد لوكلاء الاستشارة الطبية متعددة الخطوات!
أركايف للذكاءمنذ 1 شهر
👁 3أبحاث
إطار تشخيص سلوك وكلاء الذكاء الاصطناعي: ثورة في التقييم السلوكي!
أركايف للذكاءمنذ 1 شهر
👁 2نماذج لغوية
تحليل نماذج لغوية ضخمة: تقييم رياضي مبتكر للحسابات بدقة عالية!
أركايف للذكاءمنذ 1 شهر
👁 1روبوتات
IMBench: معايير مبتكرة لتحقيق التلاعب البديهي في الروبوتات
أركايف للذكاءمنذ 1 شهر
نماذج لغوية
نموذج نظرية الاستجابة الزمنية: تقييم نماذج اللغات الضخمة بدقة الاستجابة وطول سلسلة الأفكار
أركايف للذكاءمنذ 1 شهر
نماذج لغوية
اكتشفوا OmniaBench: معيار ثوري لتقييم وكلاء الذكاء الاصطناعي في سيناريوهات متنوعة!
أركايف للذكاءمنذ 1 شهر
أبحاث
تحقيق الأداء المثالي: كيف تعيد تقنيات Copy-on-Write تقييم وكالات الذكاء الاصطناعي؟
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
تجاوز هندسة الألوان: تقييم تمثيلات الألوان البشرية في نماذج الرؤية
أركايف للذكاءمنذ 1 شهر
أبحاث
CRiT-QA: ثورة في تقييم التفكير المتعدد الخطوات لمواجهة الفخاخ المُضللة!
أركايف للذكاءمنذ 1 شهر
أبحاث
Imaging-101: ثورة في التقييم وتحسين مهارات النماذج اللغوية في التصوير الحاسوبي!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
من الزخم إلى الاستقرار: كيف يُقاس ظهور الذكاء الاصطناعي بطريقة موثوقة؟
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
مؤشر حساسية التنسيق: كيف يؤثر اختيار التطبيقات على نتائج نماذج الذكاء الاصطناعي؟
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
فخ الامتثال: كيفية استهلاك وكالات الذكاء الاصطناعي لذاكرة متناقضة
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
TOPO-Bench: ثورة في تقييم الخرائط الطوبولوجية مع مقاييس قابلة للقياس
أركايف للذكاءمنذ 1 شهر
👁 2أبحاث
ثورة الذكاء الاصطناعي: كيف يؤثر تغيير القاضي على دقة نموذج الحكم؟
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
اكتشاف النقاط العمياء: تحدي جديد في نماذج الذكاء الاصطناعي متعددة الوسائط
أركايف للذكاءمنذ 1 شهر
👁 1أخلاقيات الذكاء الاصطناعي
عدم استقرار الانحياز الأخلاقي في نماذج اللغات: كيف يؤثر الإطار على القرارات الأخلاقية؟
أركايف للذكاءمنذ 1 شهر
👁 1