Ailoxa Logo

🏷️ #تقييمات

16 مقال

اكتشاف OmniMapBench: المعيار الثوري لتقييم التفكير البصري في وثائق الخرائط!
أبحاث

اكتشاف OmniMapBench: المعيار الثوري لتقييم التفكير البصري في وثائق الخرائط!

أركايف للذكاءمنذ 7 يوم
👁 1
تحقيق تقييمات مقاومة للذكاء الاصطناعي في دورات علوم الكمبيوتر: كيف يمكن للطلاب التفوق في عصر الذكاء الاصطناعي؟
أبحاث

تحقيق تقييمات مقاومة للذكاء الاصطناعي في دورات علوم الكمبيوتر: كيف يمكن للطلاب التفوق في عصر الذكاء الاصطناعي؟

أركايف للذكاءمنذ 19 يوم
ثورة في نماذج المكافآت: PEBS لتقليل الأخطاء في تحليل التعليقات الإنسانية
أبحاث

ثورة في نماذج المكافآت: PEBS لتقليل الأخطاء في تحليل التعليقات الإنسانية

أركايف للذكاءمنذ 21 يوم
👁 1
فضيحة التقييم المزدوج: بريندان فودي من ميركور يتحدى سيكويا!
أبحاث

فضيحة التقييم المزدوج: بريندان فودي من ميركور يتحدى سيكويا!

تيك كرانشمنذ 1 شهر
نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري
أخلاقيات الذكاء الاصطناعي

نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري

أركايف للذكاءمنذ 1 شهر
👁 1
معايير جديدة للذكاء الاصطناعي: تقييم شامل لنماذج الرؤية واللغة في السياق المالي الصيني
نماذج لغوية

معايير جديدة للذكاء الاصطناعي: تقييم شامل لنماذج الرؤية واللغة في السياق المالي الصيني

أركايف للذكاءمنذ 1 شهر
دليل مشترك لتقييمات موثوقة من طرف ثالث: كيف تقيم أنظمة الذكاء الاصطناعي؟
أبحاث

دليل مشترك لتقييمات موثوقة من طرف ثالث: كيف تقيم أنظمة الذكاء الاصطناعي؟

مدونة أوبن إيه آيمنذ 1 شهر
JobBench: تحوّل الذكاء الاصطناعي من استبدال البشر إلى تعزيز قدراتهم!
أدوات

JobBench: تحوّل الذكاء الاصطناعي من استبدال البشر إلى تعزيز قدراتهم!

أركايف للذكاءمنذ 1 شهر
مفاجأة في نماذج الذكاء الاصطناعي: أخطاء موقعية في سياقات طويلة قد تغير كل شيء!
أبحاث

مفاجأة في نماذج الذكاء الاصطناعي: أخطاء موقعية في سياقات طويلة قد تغير كل شيء!

أركايف للذكاءمنذ 1 شهر
كواحدٌ من الرواد في الذكاء الاصطناعي: Co-ReAct، رفيقك الجديد في اتخاذ القرارات المعقدة!
أبحاث

كواحدٌ من الرواد في الذكاء الاصطناعي: Co-ReAct، رفيقك الجديد في اتخاذ القرارات المعقدة!

أركايف للذكاءمنذ 1 شهر
👁 1
عندما تتعارض مقاييس العدالة: كيف تؤثر تقييمات العدالة السكانية على أنظمة الذكاء الاصطناعي؟
أبحاث

عندما تتعارض مقاييس العدالة: كيف تؤثر تقييمات العدالة السكانية على أنظمة الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
ثورة في تصحيح الرياضيات: كيف يمكن لنماذج اللغة الكبيرة (LLMs) رقمنة التقييمات اليدوية؟
أبحاث

ثورة في تصحيح الرياضيات: كيف يمكن لنماذج اللغة الكبيرة (LLMs) رقمنة التقييمات اليدوية؟

أركايف للذكاءمنذ 2 شهر
الألم المتزايد لنماذج الحدود: كيف تتعطل التقييمات وما الذي يجب قياسه بعد ذلك؟
أبحاث

الألم المتزايد لنماذج الحدود: كيف تتعطل التقييمات وما الذي يجب قياسه بعد ذلك؟

أركايف للذكاءمنذ 2 شهر
ما الذي يجعل مهمة تقييم وكيل التيرمينال جيدة؟ دليل لإنشاء تقييمات فعّالة وصعبة وقابلة للفهم!
أبحاث

ما الذي يجعل مهمة تقييم وكيل التيرمينال جيدة؟ دليل لإنشاء تقييمات فعّالة وصعبة وقابلة للفهم!

أركايف للذكاءمنذ 2 شهر
هل يمكننا الثقة في المراجعات الإلكترونية؟ تأثير الهجمات الانتقائية على تقييمات المنتجات!
أخلاقيات الذكاء الاصطناعي

هل يمكننا الثقة في المراجعات الإلكترونية؟ تأثير الهجمات الانتقائية على تقييمات المنتجات!

أركايف للذكاءمنذ 3 شهر
OpenAI تكشف النقاب عن إطار ثوري لمراقبة تفكير الذكاء الاصطناعي!
أبحاث

OpenAI تكشف النقاب عن إطار ثوري لمراقبة تفكير الذكاء الاصطناعي!

مدونة أوبن إيه آيمنذ 7 شهر