🏷️ #تقييم الذكاء الاصطناعي
72 مقال
أبحاث
كلو-إيفال: تقييم موثوق لوكلاء الذكاء الاصطناعي المستقلين
أركايف للذكاءمنذ 2 شهر
أبحاث
ثورة في تقييم نماذج الذكاء الاصطناعي: Prosa يغير طريقة تقييم المحادثات باللغة البرتغالية
أركايف للذكاءمنذ 2 شهر
أبحاث
نموذج NeuroState-Bench يفتح آفاق جديدة لفهم التزام الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
أبحاث
هل يلمع الصوت حقًا؟ إعادة التفكير في الاعتماد على الصوت في تقييم نماذج اللغة الصوتية
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
ثورة في تقييم نماذج الذكاء الاصطناعي: كيف تقيم الألعاب؟
أركايف للذكاءمنذ 2 شهر
أبحاث
اختبار الزمن: إعادة تفكير في تأثير التلوث الزمني على تقييم الأداء
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
AgentPulse: كيف تقوم بإعادة تعريف تقييم وكالات الذكاء الاصطناعي في بيئات العمل الديناميكية؟
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
AgencyBench: ثورة في تقييم قدرات الوكلاء الذكيين في عالم حقيقي معقد!
أركايف للذكاءمنذ 2 شهر
أبحاث
قياس الذكاء الاصطناعي: كيف تُشكّل الأنظمة الاجتماعية والخوارزمية القيم والمعاني؟
أركايف للذكاءمنذ 2 شهر
أبحاث
MEDLEY-BENCH: أداة جديدة لتقييم التفكير الذاتي في الذكاء الاصطناعي
أركايف للذكاءمنذ 3 شهر
أبحاث
ثورة الذكاء الاصطناعي في العلوم: COMPOSITE-STEM يغير قواعد اللعبة!
أركايف للذكاءمنذ 3 شهر
أبحاث
CocoaBench: أول مقياس لتقييم الوكلاء الرقميين الموحدين في مواجهة التحديات الحقيقية!
أركايف للذكاءمنذ 3 شهر
← السابق4 / 4
