Ailoxa Logo

🏷️ #التقييم

96 مقال

شهادات الهشاشة المضادة: كيفية كشف ضعف الثقة في التنبؤات الذكية
أبحاث

شهادات الهشاشة المضادة: كيفية كشف ضعف الثقة في التنبؤات الذكية

أركايف للذكاءمنذ 1 يوم
👁 1
نحو نظام تقييم موثوق وعملي لنماذج التعلم العميق!
أدوات

نحو نظام تقييم موثوق وعملي لنماذج التعلم العميق!

أركايف للذكاءمنذ 1 يوم
👁 1
كشف تصنيف التلوث: كيفية التعامل مع التحديات في تقييم نماذج الذكاء الاصطناعي
أبحاث

كشف تصنيف التلوث: كيفية التعامل مع التحديات في تقييم نماذج الذكاء الاصطناعي

أركايف للذكاءمنذ 2 يوم
👁 1
بين النماذج والقياسات: دراسة تكشف عن تكرارية ملحوظة في معايير الذكاء الاصطناعي الفيزيائي!
أبحاث

بين النماذج والقياسات: دراسة تكشف عن تكرارية ملحوظة في معايير الذكاء الاصطناعي الفيزيائي!

أركايف للذكاءمنذ 2 يوم
👁 1
رحلة إلى عالم الذكاء الاصطناعي: كيف تقيم وكالات البرمجة أداءها في طلبات المستخدمين الحقيقية؟
أبحاث

رحلة إلى عالم الذكاء الاصطناعي: كيف تقيم وكالات البرمجة أداءها في طلبات المستخدمين الحقيقية؟

أركايف للذكاءمنذ 2 يوم
استعد للثورة: أداة AgentJudgeBench لتقييم موثوقية القضاة الذكيين في الأنظمة الوكيلة
أبحاث

استعد للثورة: أداة AgentJudgeBench لتقييم موثوقية القضاة الذكيين في الأنظمة الوكيلة

أركايف للذكاءمنذ 6 يوم
👁 2
تقييم جديد: معايير تحرير المعرفة تُظهر تحديات خطيرة في تصنيف النطاق!
أبحاث

تقييم جديد: معايير تحرير المعرفة تُظهر تحديات خطيرة في تصنيف النطاق!

أركايف للذكاءمنذ 6 يوم
👁 1
الذكاء الاصطناعي القائم على الوكلاء المتمثلين: تحسينات جديدة تعزز المرونة والثقة بين الإنسان والآلة!
أبحاث

الذكاء الاصطناعي القائم على الوكلاء المتمثلين: تحسينات جديدة تعزز المرونة والثقة بين الإنسان والآلة!

أركايف للذكاءمنذ 8 يوم
Wazobia Eval: ثورة في فهم مشاعر ورموز اللغة النيجيرية!
أبحاث

Wazobia Eval: ثورة في فهم مشاعر ورموز اللغة النيجيرية!

أركايف للذكاءمنذ 9 يوم
👁 1
اختبار وتقييم أنظمة الذكاء الاصطناعي الفاعلة في القيادة والسيطرة العسكرية: هل نحن مستعدون؟
أبحاث

اختبار وتقييم أنظمة الذكاء الاصطناعي الفاعلة في القيادة والسيطرة العسكرية: هل نحن مستعدون؟

أركايف للذكاءمنذ 10 يوم
تحقيقات التقييم خطوة بخطوة: كيف تتعامل نماذج اللغات الضخمة (LLM) مع الائتمان بدون حقائق واضحة؟
أبحاث

تحقيقات التقييم خطوة بخطوة: كيف تتعامل نماذج اللغات الضخمة (LLM) مع الائتمان بدون حقائق واضحة؟

أركايف للذكاءمنذ 13 يوم
👁 2
نموذج لغوي متعدد الأنماط يتحدى امتحانات تشغيل المفاعلات النووية: استراتيجيات التحليل والتطوير
أبحاث

نموذج لغوي متعدد الأنماط يتحدى امتحانات تشغيل المفاعلات النووية: استراتيجيات التحليل والتطوير

أركايف للذكاءمنذ 16 يوم
نظام مبتكر لجمع الأدلة لتحسين النزاهة الأكاديمية: مستقبل تقييم الطلاب
أبحاث

نظام مبتكر لجمع الأدلة لتحسين النزاهة الأكاديمية: مستقبل تقييم الطلاب

أركايف للذكاءمنذ 16 يوم
👁 1
كيف يمكن تقييم قدرات النماذج اللغوية الكبيرة في الإبداع الرياضي؟
أبحاث

كيف يمكن تقييم قدرات النماذج اللغوية الكبيرة في الإبداع الرياضي؟

أركايف للذكاءمنذ 16 يوم
👁 1
تحسين دقة حكام نماذج اللغات الضخمة: مواجهة التداخل في معايير التقييم
نماذج لغوية

تحسين دقة حكام نماذج اللغات الضخمة: مواجهة التداخل في معايير التقييم

أركايف للذكاءمنذ 16 يوم
👁 1
ثورة في تقييم موثوقية نماذج اللغات الضخمة: معيار جديد ينظم القوانين!
أبحاث

ثورة في تقييم موثوقية نماذج اللغات الضخمة: معيار جديد ينظم القوانين!

أركايف للذكاءمنذ 17 يوم
👁 1
ثورة في تقييم الذكاء الاصطناعي: التعاون مع البشر هو الحل!
أبحاث

ثورة في تقييم الذكاء الاصطناعي: التعاون مع البشر هو الحل!

أركايف للذكاءمنذ 17 يوم
👁 1
مفهوم LOB-ID: كيف تغير التكنولوجيا تقييم بيانات الأسواق بشكل جذري؟
أبحاث

مفهوم LOB-ID: كيف تغير التكنولوجيا تقييم بيانات الأسواق بشكل جذري؟

أركايف للذكاءمنذ 20 يوم
👁 1
تطور مذهل في ذكاء واجهات المستخدم: إطار عمل لتكييف النماذج بعد النشر!
أبحاث

تطور مذهل في ذكاء واجهات المستخدم: إطار عمل لتكييف النماذج بعد النشر!

أركايف للذكاءمنذ 22 يوم
👁 2
هل هذه هي إجابتك النهائية؟ قياس موثوقية نماذج اللغات الضخمة عبر الثبات بين السياقات!
أبحاث

هل هذه هي إجابتك النهائية؟ قياس موثوقية نماذج اللغات الضخمة عبر الثبات بين السياقات!

أركايف للذكاءمنذ 22 يوم