🏷️ #تقييمات
24 مقال
أبحاث
KC-Bench: منصة مبتكرة لمراجعة التناقضات المعرفية في نماذج اللغات الضخمة
أركايف للذكاءمنذ 17 ساعة
أبحاث
كشف الستار عن قرارات التعلم المعزز في الأنظمة الذاتية التكيف
أركايف للذكاءمنذ 17 يوم
👁 1أبحاث
هل تملك الذكاء الاصطناعي؟ تصميم تقييمات جديدة في عصر GenAI
أركايف للذكاءمنذ 21 يوم
أبحاث
نحو تقييم RAG مستقل عن الاستعلام: تحقيق تحليل دقيق عبر تغطية الاستعلام وموثوقية المطالبات
أركايف للذكاءمنذ 22 يوم
👁 1أبحاث
ابتكار مذهل في توليد الصور: إطار عمل Atelier لتحسين الإبداع الفني
أركايف للذكاءمنذ 25 يوم
أبحاث
هل يمكن للنصوص التقييمية أن تنبئ بسمعة العروض التقديرية في منصات الإيجارات القصيرة؟
أركايف للذكاءمنذ 29 يوم
👁 1أبحاث
كيف يمكن لنماذج اللغة تحسين الاقتصاد؟ اكتشافات جديدة مثيرة!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
توقعات خالية من التلوث: كأس العالم 2026 كمرجع مبتكر لنماذج الذكاء الاصطناعي!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
اكتشاف OmniMapBench: المعيار الثوري لتقييم التفكير البصري في وثائق الخرائط!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
تحقيق تقييمات مقاومة للذكاء الاصطناعي في دورات علوم الكمبيوتر: كيف يمكن للطلاب التفوق في عصر الذكاء الاصطناعي؟
أركايف للذكاءمنذ 2 شهر
أبحاث
ثورة في نماذج المكافآت: PEBS لتقليل الأخطاء في تحليل التعليقات الإنسانية
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
فضيحة التقييم المزدوج: بريندان فودي من ميركور يتحدى سيكويا!
تيك كرانشمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري
أركايف للذكاءمنذ 3 شهر
👁 1نماذج لغوية
معايير جديدة للذكاء الاصطناعي: تقييم شامل لنماذج الرؤية واللغة في السياق المالي الصيني
أركايف للذكاءمنذ 3 شهر
👁 1أبحاث
دليل مشترك لتقييمات موثوقة من طرف ثالث: كيف تقيم أنظمة الذكاء الاصطناعي؟
مدونة أوبن إيه آيمنذ 3 شهر
أدوات
JobBench: تحوّل الذكاء الاصطناعي من استبدال البشر إلى تعزيز قدراتهم!
أركايف للذكاءمنذ 3 شهر
أبحاث
مفاجأة في نماذج الذكاء الاصطناعي: أخطاء موقعية في سياقات طويلة قد تغير كل شيء!
أركايف للذكاءمنذ 3 شهر
أبحاث
كواحدٌ من الرواد في الذكاء الاصطناعي: Co-ReAct، رفيقك الجديد في اتخاذ القرارات المعقدة!
أركايف للذكاءمنذ 3 شهر
👁 1أبحاث
عندما تتعارض مقاييس العدالة: كيف تؤثر تقييمات العدالة السكانية على أنظمة الذكاء الاصطناعي؟
أركايف للذكاءمنذ 3 شهر
أبحاث
الألم المتزايد لنماذج الحدود: كيف تتعطل التقييمات وما الذي يجب قياسه بعد ذلك؟
أركايف للذكاءمنذ 3 شهر
1 / 2التالي →
