🏷️ #التقييم
65 مقال
أبحاث
توقع صعوبة الأسئلة الاختيارية: كيف يغير الذكاء الاصطناعي طريقة تقييم القدرات الدراسية؟
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تجربة ثورية: تقييم دقة ChatGPT في ترميز بيانات التواصل عبر الفئات المختلفة!
أركايف للذكاءمنذ 2 شهر
نماذج لغوية
هل يمكن لنماذج اللغات الضخمة رفض الإجابة عن الأسئلة التي لا تعرفها؟ اكتشفوا قدرة الرفض المعرفي!
أركايف للذكاءمنذ 2 شهر
أبحاث
MANTA: الإطار الثوري لتقييم التفكير غير البشري والمواءمة في الذكاء الاصطناعي
أركايف للذكاءمنذ 2 شهر
أبحاث
ShopGym: الإطار المتكامل الذي يغير قواعد لعبة تقييم وكيل التجارة الإلكترونية!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تقييم شامل وتشخيص فشل وكلاء الذكاء الاصطناعي: ثورة في تحليل الأداء
أركايف للذكاءمنذ 2 شهر
أبحاث
تحسين نماذج اللغة الشاملة: خطوات ما بعد التدريب وتأثير التقييم الخالي من التحيز البصري
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشاف أبعاد جديدة في الذكاء الاصطناعي: تحسين تقنيات AIVAT لتقليل التباين وزيادة الدقة!
أركايف للذكاءمنذ 2 شهر
أبحاث
ريزد: إطار تقييم سلامة الذكاء الاصطناعي قبل التنفيذ لتحسين أنظمة الدعم القرار السريرية
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
GSM-SEM: الإطار الثوري لتوليد تنويعات ذات دلالة لتعزيز قياس الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
أبحاث
اختبار الأدلة الجزئية: معيار جديد للتقييم في أنظمة الوكالة المحدودة
أركايف للذكاءمنذ 2 شهر
أبحاث
معيار موحد لتقييم طرق بناء الرسوم البيانية المعرفية والشبكات العصبية الرسومية!
أركايف للذكاءمنذ 2 شهر
أبحاث
إعادة التفكير في فاعلية تقييم اكتشاف البيانات الخارجية من خلال التعلم العميق الدلالي
أركايف للذكاءمنذ 2 شهر
أبحاث
فهم سياسة سلامة المعلّقين: كيف تجعل التعلم الآلي أكثر أماناً وشفافية
أركايف للذكاءمنذ 2 شهر
أبحاث
نحو تحسين جودة وصف الصوت: أداة مبتكرة لتقييم المحللين البشريين ونماذج اللغة المرئية
أركايف للذكاءمنذ 2 شهر
أبحاث
STABLEVAL: الإطار الثوري لتقييم أنظمة الذكاء الاصطناعي بوعي الخلاف واستقرار النتائج!
أركايف للذكاءمنذ 2 شهر
أبحاث
TMD-Bench: منصة تقييم مبتكرة لتوليد الموسيقى والرقص بشكل متزامن!
أركايف للذكاءمنذ 2 شهر
نماذج لغوية
تجاوز الأعداد: كيف تقيم جودة تفكير نماذج اللغات الضخمة (LLMs) من خلال الهندسة والتوازن
أركايف للذكاءمنذ 2 شهر
أبحاث
إطلاق إطار شامل لتقييم الحوكمة المستمر للذكاء الاصطناعي في الأنظمة السريرية!
أركايف للذكاءمنذ 2 شهر
أبحاث
اختبارات الذكاء الاصطناعي: كيف أصبحت أداة التقييم الجديدة عبئًا على الأداء! 🚀
هاجينج فيسمنذ 2 شهر
