Ailoxa Logo

🏷️ #تقييمات

24 مقال

KC-Bench: منصة مبتكرة لمراجعة التناقضات المعرفية في نماذج اللغات الضخمة
أبحاث

KC-Bench: منصة مبتكرة لمراجعة التناقضات المعرفية في نماذج اللغات الضخمة

أركايف للذكاءمنذ 19 ساعة
كشف الستار عن قرارات التعلم المعزز في الأنظمة الذاتية التكيف
أبحاث

كشف الستار عن قرارات التعلم المعزز في الأنظمة الذاتية التكيف

أركايف للذكاءمنذ 17 يوم
👁 1
هل تملك الذكاء الاصطناعي؟ تصميم تقييمات جديدة في عصر GenAI
أبحاث

هل تملك الذكاء الاصطناعي؟ تصميم تقييمات جديدة في عصر GenAI

أركايف للذكاءمنذ 21 يوم
نحو تقييم RAG مستقل عن الاستعلام: تحقيق تحليل دقيق عبر تغطية الاستعلام وموثوقية المطالبات
أبحاث

نحو تقييم RAG مستقل عن الاستعلام: تحقيق تحليل دقيق عبر تغطية الاستعلام وموثوقية المطالبات

أركايف للذكاءمنذ 22 يوم
👁 1
ابتكار مذهل في توليد الصور: إطار عمل Atelier لتحسين الإبداع الفني
أبحاث

ابتكار مذهل في توليد الصور: إطار عمل Atelier لتحسين الإبداع الفني

أركايف للذكاءمنذ 25 يوم
هل يمكن للنصوص التقييمية أن تنبئ بسمعة العروض التقديرية في منصات الإيجارات القصيرة؟
أبحاث

هل يمكن للنصوص التقييمية أن تنبئ بسمعة العروض التقديرية في منصات الإيجارات القصيرة؟

أركايف للذكاءمنذ 29 يوم
👁 1
كيف يمكن لنماذج اللغة تحسين الاقتصاد؟ اكتشافات جديدة مثيرة!
أبحاث

كيف يمكن لنماذج اللغة تحسين الاقتصاد؟ اكتشافات جديدة مثيرة!

أركايف للذكاءمنذ 1 شهر
👁 1
توقعات خالية من التلوث: كأس العالم 2026 كمرجع مبتكر لنماذج الذكاء الاصطناعي!
أبحاث

توقعات خالية من التلوث: كأس العالم 2026 كمرجع مبتكر لنماذج الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
👁 1
اكتشاف OmniMapBench: المعيار الثوري لتقييم التفكير البصري في وثائق الخرائط!
أبحاث

اكتشاف OmniMapBench: المعيار الثوري لتقييم التفكير البصري في وثائق الخرائط!

أركايف للذكاءمنذ 1 شهر
👁 1
تحقيق تقييمات مقاومة للذكاء الاصطناعي في دورات علوم الكمبيوتر: كيف يمكن للطلاب التفوق في عصر الذكاء الاصطناعي؟
أبحاث

تحقيق تقييمات مقاومة للذكاء الاصطناعي في دورات علوم الكمبيوتر: كيف يمكن للطلاب التفوق في عصر الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
ثورة في نماذج المكافآت: PEBS لتقليل الأخطاء في تحليل التعليقات الإنسانية
أبحاث

ثورة في نماذج المكافآت: PEBS لتقليل الأخطاء في تحليل التعليقات الإنسانية

أركايف للذكاءمنذ 2 شهر
👁 1
فضيحة التقييم المزدوج: بريندان فودي من ميركور يتحدى سيكويا!
أبحاث

فضيحة التقييم المزدوج: بريندان فودي من ميركور يتحدى سيكويا!

تيك كرانشمنذ 2 شهر
نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري
أخلاقيات الذكاء الاصطناعي

نظام NoRA: تقييم المعقولية المبنية على السياق في اتخاذ القرارات الأخلاقية من منظور بصري

أركايف للذكاءمنذ 3 شهر
👁 1
معايير جديدة للذكاء الاصطناعي: تقييم شامل لنماذج الرؤية واللغة في السياق المالي الصيني
نماذج لغوية

معايير جديدة للذكاء الاصطناعي: تقييم شامل لنماذج الرؤية واللغة في السياق المالي الصيني

أركايف للذكاءمنذ 3 شهر
👁 1
دليل مشترك لتقييمات موثوقة من طرف ثالث: كيف تقيم أنظمة الذكاء الاصطناعي؟
أبحاث

دليل مشترك لتقييمات موثوقة من طرف ثالث: كيف تقيم أنظمة الذكاء الاصطناعي؟

مدونة أوبن إيه آيمنذ 3 شهر
JobBench: تحوّل الذكاء الاصطناعي من استبدال البشر إلى تعزيز قدراتهم!
أدوات

JobBench: تحوّل الذكاء الاصطناعي من استبدال البشر إلى تعزيز قدراتهم!

أركايف للذكاءمنذ 3 شهر
مفاجأة في نماذج الذكاء الاصطناعي: أخطاء موقعية في سياقات طويلة قد تغير كل شيء!
أبحاث

مفاجأة في نماذج الذكاء الاصطناعي: أخطاء موقعية في سياقات طويلة قد تغير كل شيء!

أركايف للذكاءمنذ 3 شهر
كواحدٌ من الرواد في الذكاء الاصطناعي: Co-ReAct، رفيقك الجديد في اتخاذ القرارات المعقدة!
أبحاث

كواحدٌ من الرواد في الذكاء الاصطناعي: Co-ReAct، رفيقك الجديد في اتخاذ القرارات المعقدة!

أركايف للذكاءمنذ 3 شهر
👁 1
عندما تتعارض مقاييس العدالة: كيف تؤثر تقييمات العدالة السكانية على أنظمة الذكاء الاصطناعي؟
أبحاث

عندما تتعارض مقاييس العدالة: كيف تؤثر تقييمات العدالة السكانية على أنظمة الذكاء الاصطناعي؟

أركايف للذكاءمنذ 3 شهر
الألم المتزايد لنماذج الحدود: كيف تتعطل التقييمات وما الذي يجب قياسه بعد ذلك؟
أبحاث

الألم المتزايد لنماذج الحدود: كيف تتعطل التقييمات وما الذي يجب قياسه بعد ذلك؟

أركايف للذكاءمنذ 3 شهر