🏷️ #تقييم نماذج اللغة
8 مقال
أبحاث
ثورة في تقييم نماذج اللغة: ExecRubrics توفر إطارًا مبتكرًا لتقييم فعّال وشفاف!
أركايف للذكاءمنذ 9 يوم
👁 1أبحاث
من يفكر أفضل يعتمد على الوقت: تصنيف نماذج اللغة الكبيرة وفق الميزانية!
أركايف للذكاءمنذ 21 يوم
👁 1أبحاث
تطورات مثيرة في تقييم الذكاء الاصطناعي: كيفية مقارنة نماذج الصحة النفسية بدقة وموضوعية!
أركايف للذكاءمنذ 1 شهر
أبحاث
CARV: معيار تشخيصي جديد لتقييم القدرة على الاستدلال التمثيلي في نماذج اللغة متعددة الوسائط!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
اختبار متكيف لتقييم نماذج اللغة الكبيرة: بديل سيكومتري لمؤشرات الأداء الثابتة
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
التحليل الإحصائي للذكاء الاصطناعي: مكتبة evalci تُحدث ثورة في تقييم نماذج اللغة
أركايف للذكاءمنذ 1 شهر
أبحاث
من الذي انحرف: النظام أم القاضي؟ كشف النقاب عن تفاصيل جديدة في تقييم نماذج اللغة الضخمة
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشاف أبعاد جديدة في تقييم نماذج لغات الذكاء الاصطناعي مع Omanic!
أركايف للذكاءمنذ 3 شهر
