Ailoxa Logo

🏷️ #التقييم

65 مقال

توقع صعوبة الأسئلة الاختيارية: كيف يغير الذكاء الاصطناعي طريقة تقييم القدرات الدراسية؟
أبحاث

توقع صعوبة الأسئلة الاختيارية: كيف يغير الذكاء الاصطناعي طريقة تقييم القدرات الدراسية؟

أركايف للذكاءمنذ 2 شهر
👁 1
تجربة ثورية: تقييم دقة ChatGPT في ترميز بيانات التواصل عبر الفئات المختلفة!
أبحاث

تجربة ثورية: تقييم دقة ChatGPT في ترميز بيانات التواصل عبر الفئات المختلفة!

أركايف للذكاءمنذ 2 شهر
هل يمكن لنماذج اللغات الضخمة رفض الإجابة عن الأسئلة التي لا تعرفها؟ اكتشفوا قدرة الرفض المعرفي!
نماذج لغوية

هل يمكن لنماذج اللغات الضخمة رفض الإجابة عن الأسئلة التي لا تعرفها؟ اكتشفوا قدرة الرفض المعرفي!

أركايف للذكاءمنذ 2 شهر
MANTA: الإطار الثوري لتقييم التفكير غير البشري والمواءمة في الذكاء الاصطناعي
أبحاث

MANTA: الإطار الثوري لتقييم التفكير غير البشري والمواءمة في الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
ShopGym: الإطار المتكامل الذي يغير قواعد لعبة تقييم وكيل التجارة الإلكترونية!
أبحاث

ShopGym: الإطار المتكامل الذي يغير قواعد لعبة تقييم وكيل التجارة الإلكترونية!

أركايف للذكاءمنذ 2 شهر
👁 1
تقييم شامل وتشخيص فشل وكلاء الذكاء الاصطناعي: ثورة في تحليل الأداء
أبحاث

تقييم شامل وتشخيص فشل وكلاء الذكاء الاصطناعي: ثورة في تحليل الأداء

أركايف للذكاءمنذ 2 شهر
تحسين نماذج اللغة الشاملة: خطوات ما بعد التدريب وتأثير التقييم الخالي من التحيز البصري
أبحاث

تحسين نماذج اللغة الشاملة: خطوات ما بعد التدريب وتأثير التقييم الخالي من التحيز البصري

أركايف للذكاءمنذ 2 شهر
اكتشاف أبعاد جديدة في الذكاء الاصطناعي: تحسين تقنيات AIVAT لتقليل التباين وزيادة الدقة!
أبحاث

اكتشاف أبعاد جديدة في الذكاء الاصطناعي: تحسين تقنيات AIVAT لتقليل التباين وزيادة الدقة!

أركايف للذكاءمنذ 2 شهر
ريزد: إطار تقييم سلامة الذكاء الاصطناعي قبل التنفيذ لتحسين أنظمة الدعم القرار السريرية
أبحاث

ريزد: إطار تقييم سلامة الذكاء الاصطناعي قبل التنفيذ لتحسين أنظمة الدعم القرار السريرية

أركايف للذكاءمنذ 2 شهر
👁 1
GSM-SEM: الإطار الثوري لتوليد تنويعات ذات دلالة لتعزيز قياس الذكاء الاصطناعي!
أبحاث

GSM-SEM: الإطار الثوري لتوليد تنويعات ذات دلالة لتعزيز قياس الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
اختبار الأدلة الجزئية: معيار جديد للتقييم في أنظمة الوكالة المحدودة
أبحاث

اختبار الأدلة الجزئية: معيار جديد للتقييم في أنظمة الوكالة المحدودة

أركايف للذكاءمنذ 2 شهر
معيار موحد لتقييم طرق بناء الرسوم البيانية المعرفية والشبكات العصبية الرسومية!
أبحاث

معيار موحد لتقييم طرق بناء الرسوم البيانية المعرفية والشبكات العصبية الرسومية!

أركايف للذكاءمنذ 2 شهر
إعادة التفكير في فاعلية تقييم اكتشاف البيانات الخارجية من خلال التعلم العميق الدلالي
أبحاث

إعادة التفكير في فاعلية تقييم اكتشاف البيانات الخارجية من خلال التعلم العميق الدلالي

أركايف للذكاءمنذ 2 شهر
فهم سياسة سلامة المعلّقين: كيف تجعل التعلم الآلي أكثر أماناً وشفافية
أبحاث

فهم سياسة سلامة المعلّقين: كيف تجعل التعلم الآلي أكثر أماناً وشفافية

أركايف للذكاءمنذ 2 شهر
نحو تحسين جودة وصف الصوت: أداة مبتكرة لتقييم المحللين البشريين ونماذج اللغة المرئية
أبحاث

نحو تحسين جودة وصف الصوت: أداة مبتكرة لتقييم المحللين البشريين ونماذج اللغة المرئية

أركايف للذكاءمنذ 2 شهر
STABLEVAL: الإطار الثوري لتقييم أنظمة الذكاء الاصطناعي بوعي الخلاف واستقرار النتائج!
أبحاث

STABLEVAL: الإطار الثوري لتقييم أنظمة الذكاء الاصطناعي بوعي الخلاف واستقرار النتائج!

أركايف للذكاءمنذ 2 شهر
TMD-Bench: منصة تقييم مبتكرة لتوليد الموسيقى والرقص بشكل متزامن!
أبحاث

TMD-Bench: منصة تقييم مبتكرة لتوليد الموسيقى والرقص بشكل متزامن!

أركايف للذكاءمنذ 2 شهر
تجاوز الأعداد: كيف تقيم جودة تفكير نماذج اللغات الضخمة (LLMs) من خلال الهندسة والتوازن
نماذج لغوية

تجاوز الأعداد: كيف تقيم جودة تفكير نماذج اللغات الضخمة (LLMs) من خلال الهندسة والتوازن

أركايف للذكاءمنذ 2 شهر
إطلاق إطار شامل لتقييم الحوكمة المستمر للذكاء الاصطناعي في الأنظمة السريرية!
أبحاث

إطلاق إطار شامل لتقييم الحوكمة المستمر للذكاء الاصطناعي في الأنظمة السريرية!

أركايف للذكاءمنذ 2 شهر
اختبارات الذكاء الاصطناعي: كيف أصبحت أداة التقييم الجديدة عبئًا على الأداء! 🚀
أبحاث

اختبارات الذكاء الاصطناعي: كيف أصبحت أداة التقييم الجديدة عبئًا على الأداء! 🚀

هاجينج فيسمنذ 2 شهر