Ailoxa Logo

🏷️ #تقييم

379 مقال

تحسين نتائج التعليم: تقييم جماعي لمهارات حل المشكلات باستخدام الذكاء الاصطناعي
أبحاث

تحسين نتائج التعليم: تقييم جماعي لمهارات حل المشكلات باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
👁 1
كيف يسخر الذكاء الاصطناعي من الفكاهة متعددة الوسائط؟ اكتشفوا التحديات والإمكانيات!
أبحاث

كيف يسخر الذكاء الاصطناعي من الفكاهة متعددة الوسائط؟ اكتشفوا التحديات والإمكانيات!

أركايف للذكاءمنذ 1 شهر
👁 1
Relay-Bench: ثورة في تقييم نماذج الذكاء الاصطناعي عبر تحديات متعددة المجالات!
أبحاث

Relay-Bench: ثورة في تقييم نماذج الذكاء الاصطناعي عبر تحديات متعددة المجالات!

أركايف للذكاءمنذ 1 شهر
👁 1
مستقبل التشخيص الطبي: MedDDC-Eval يكشف عن تقييم جديد لوكلاء الاستشارة الطبية متعددة الخطوات!
أبحاث

مستقبل التشخيص الطبي: MedDDC-Eval يكشف عن تقييم جديد لوكلاء الاستشارة الطبية متعددة الخطوات!

أركايف للذكاءمنذ 1 شهر
👁 3
إطار تشخيص سلوك وكلاء الذكاء الاصطناعي: ثورة في التقييم السلوكي!
أبحاث

إطار تشخيص سلوك وكلاء الذكاء الاصطناعي: ثورة في التقييم السلوكي!

أركايف للذكاءمنذ 1 شهر
👁 2
تحليل نماذج لغوية ضخمة: تقييم رياضي مبتكر للحسابات بدقة عالية!
نماذج لغوية

تحليل نماذج لغوية ضخمة: تقييم رياضي مبتكر للحسابات بدقة عالية!

أركايف للذكاءمنذ 1 شهر
👁 1
IMBench: معايير مبتكرة لتحقيق التلاعب البديهي في الروبوتات
روبوتات

IMBench: معايير مبتكرة لتحقيق التلاعب البديهي في الروبوتات

أركايف للذكاءمنذ 1 شهر
نموذج نظرية الاستجابة الزمنية: تقييم نماذج اللغات الضخمة بدقة الاستجابة وطول سلسلة الأفكار
نماذج لغوية

نموذج نظرية الاستجابة الزمنية: تقييم نماذج اللغات الضخمة بدقة الاستجابة وطول سلسلة الأفكار

أركايف للذكاءمنذ 1 شهر
اكتشفوا OmniaBench: معيار ثوري لتقييم وكلاء الذكاء الاصطناعي في سيناريوهات متنوعة!
نماذج لغوية

اكتشفوا OmniaBench: معيار ثوري لتقييم وكلاء الذكاء الاصطناعي في سيناريوهات متنوعة!

أركايف للذكاءمنذ 1 شهر
تحقيق الأداء المثالي: كيف تعيد تقنيات Copy-on-Write تقييم وكالات الذكاء الاصطناعي؟
أبحاث

تحقيق الأداء المثالي: كيف تعيد تقنيات Copy-on-Write تقييم وكالات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
👁 1
تجاوز هندسة الألوان: تقييم تمثيلات الألوان البشرية في نماذج الرؤية
أبحاث

تجاوز هندسة الألوان: تقييم تمثيلات الألوان البشرية في نماذج الرؤية

أركايف للذكاءمنذ 1 شهر
CRiT-QA: ثورة في تقييم التفكير المتعدد الخطوات لمواجهة الفخاخ المُضللة!
أبحاث

CRiT-QA: ثورة في تقييم التفكير المتعدد الخطوات لمواجهة الفخاخ المُضللة!

أركايف للذكاءمنذ 1 شهر
Imaging-101: ثورة في التقييم وتحسين مهارات النماذج اللغوية في التصوير الحاسوبي!
أبحاث

Imaging-101: ثورة في التقييم وتحسين مهارات النماذج اللغوية في التصوير الحاسوبي!

أركايف للذكاءمنذ 1 شهر
👁 1
من الزخم إلى الاستقرار: كيف يُقاس ظهور الذكاء الاصطناعي بطريقة موثوقة؟
أبحاث

من الزخم إلى الاستقرار: كيف يُقاس ظهور الذكاء الاصطناعي بطريقة موثوقة؟

أركايف للذكاءمنذ 1 شهر
👁 1
مؤشر حساسية التنسيق: كيف يؤثر اختيار التطبيقات على نتائج نماذج الذكاء الاصطناعي؟
أبحاث

مؤشر حساسية التنسيق: كيف يؤثر اختيار التطبيقات على نتائج نماذج الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
👁 1
فخ الامتثال: كيفية استهلاك وكالات الذكاء الاصطناعي لذاكرة متناقضة
أبحاث

فخ الامتثال: كيفية استهلاك وكالات الذكاء الاصطناعي لذاكرة متناقضة

أركايف للذكاءمنذ 1 شهر
👁 1
TOPO-Bench: ثورة في تقييم الخرائط الطوبولوجية مع مقاييس قابلة للقياس
أبحاث

TOPO-Bench: ثورة في تقييم الخرائط الطوبولوجية مع مقاييس قابلة للقياس

أركايف للذكاءمنذ 1 شهر
👁 2
ثورة الذكاء الاصطناعي: كيف يؤثر تغيير القاضي على دقة نموذج الحكم؟
أبحاث

ثورة الذكاء الاصطناعي: كيف يؤثر تغيير القاضي على دقة نموذج الحكم؟

أركايف للذكاءمنذ 1 شهر
👁 1
اكتشاف النقاط العمياء: تحدي جديد في نماذج الذكاء الاصطناعي متعددة الوسائط
أبحاث

اكتشاف النقاط العمياء: تحدي جديد في نماذج الذكاء الاصطناعي متعددة الوسائط

أركايف للذكاءمنذ 1 شهر
👁 1
عدم استقرار الانحياز الأخلاقي في نماذج اللغات: كيف يؤثر الإطار على القرارات الأخلاقية؟
أخلاقيات الذكاء الاصطناعي

عدم استقرار الانحياز الأخلاقي في نماذج اللغات: كيف يؤثر الإطار على القرارات الأخلاقية؟

أركايف للذكاءمنذ 1 شهر
👁 1