🏷️ #تقييمات
16 مقال
أبحاث
اكتشاف OmniMapBench: المعيار الثوري لتقييم التفكير البصري في وثائق الخرائط!
أركايف للذكاءمنذ 7 يوم
👁 1أبحاث
تحقيق تقييمات مقاومة للذكاء الاصطناعي في دورات علوم الكمبيوتر: كيف يمكن للطلاب التفوق في عصر الذكاء الاصطناعي؟
أركايف للذكاءمنذ 19 يوم
أبحاث
ثورة في نماذج المكافآت: PEBS لتقليل الأخطاء في تحليل التعليقات الإنسانية
أركايف للذكاءمنذ 21 يوم
👁 1أبحاث
فضيحة التقييم المزدوج: بريندان فودي من ميركور يتحدى سيكويا!
تيك كرانشمنذ 1 شهر
أخلاقيات الذكاء الاصطناعي
نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري
أركايف للذكاءمنذ 1 شهر
👁 1نماذج لغوية
معايير جديدة للذكاء الاصطناعي: تقييم شامل لنماذج الرؤية واللغة في السياق المالي الصيني
أركايف للذكاءمنذ 1 شهر
أبحاث
دليل مشترك لتقييمات موثوقة من طرف ثالث: كيف تقيم أنظمة الذكاء الاصطناعي؟
مدونة أوبن إيه آيمنذ 1 شهر
أدوات
JobBench: تحوّل الذكاء الاصطناعي من استبدال البشر إلى تعزيز قدراتهم!
أركايف للذكاءمنذ 1 شهر
أبحاث
مفاجأة في نماذج الذكاء الاصطناعي: أخطاء موقعية في سياقات طويلة قد تغير كل شيء!
أركايف للذكاءمنذ 1 شهر
أبحاث
كواحدٌ من الرواد في الذكاء الاصطناعي: Co-ReAct، رفيقك الجديد في اتخاذ القرارات المعقدة!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
عندما تتعارض مقاييس العدالة: كيف تؤثر تقييمات العدالة السكانية على أنظمة الذكاء الاصطناعي؟
أركايف للذكاءمنذ 1 شهر
أبحاث
ثورة في تصحيح الرياضيات: كيف يمكن لنماذج اللغة الكبيرة (LLMs) رقمنة التقييمات اليدوية؟
أركايف للذكاءمنذ 2 شهر
أبحاث
الألم المتزايد لنماذج الحدود: كيف تتعطل التقييمات وما الذي يجب قياسه بعد ذلك؟
أركايف للذكاءمنذ 2 شهر
أبحاث
ما الذي يجعل مهمة تقييم وكيل التيرمينال جيدة؟ دليل لإنشاء تقييمات فعّالة وصعبة وقابلة للفهم!
أركايف للذكاءمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
هل يمكننا الثقة في المراجعات الإلكترونية؟ تأثير الهجمات الانتقائية على تقييمات المنتجات!
أركايف للذكاءمنذ 3 شهر
أبحاث
OpenAI تكشف النقاب عن إطار ثوري لمراقبة تفكير الذكاء الاصطناعي!
مدونة أوبن إيه آيمنذ 7 شهر
