Ailoxa Logo

🏷️ #تقييم أداء

22 مقال

الأبعاد الخفية لأداء الذكاء الاصطناعي في الرعاية الصحية: هل تقييمات الأداء تكشف الحقيقة؟
أبحاث

الأبعاد الخفية لأداء الذكاء الاصطناعي في الرعاية الصحية: هل تقييمات الأداء تكشف الحقيقة؟

أركايف للذكاءمنذ 12 يوم
نحو تفوق في الذكاء الاصطناعي: تقييم شامل لنماذج التأسيس الهندية
أبحاث

نحو تفوق في الذكاء الاصطناعي: تقييم شامل لنماذج التأسيس الهندية

أركايف للذكاءمنذ 1 شهر
👁 1
NavTrust: معيار جديد لقياس الموثوقية في التنقل الجسدي!
أبحاث

NavTrust: معيار جديد لقياس الموثوقية في التنقل الجسدي!

أركايف للذكاءمنذ 1 شهر
👁 1
MemArena: ثورة في قياس الأداء لذكاء المساعدين الشخصيين باستخدام الذاكرة الذاتية!
أبحاث

MemArena: ثورة في قياس الأداء لذكاء المساعدين الشخصيين باستخدام الذاكرة الذاتية!

أركايف للذكاءمنذ 1 شهر
👁 2
اكتشف HANDBOOK.md: معيار جديد لقياس أداء نماذج الذكاء الاصطناعي في اتباع التعليمات المطوّلة!
أبحاث

اكتشف HANDBOOK.md: معيار جديد لقياس أداء نماذج الذكاء الاصطناعي في اتباع التعليمات المطوّلة!

أركايف للذكاءمنذ 1 شهر
👁 2
إطلاق ARCO: ثورة جديدة في تقييم أداء وكلاء الذكاء الاصطناعي!
أبحاث

إطلاق ARCO: ثورة جديدة في تقييم أداء وكلاء الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
اكتشاف SenWorld: ثورة في تقييم المساعدين الشخصيين من خلال محاكاة رقمية مبتكرة!
أبحاث

اكتشاف SenWorld: ثورة في تقييم المساعدين الشخصيين من خلال محاكاة رقمية مبتكرة!

أركايف للذكاءمنذ 1 شهر
👁 1
اختيار مجموعات الموجهات دون إشراف: استراتيجيات جديدة لقياس أداء نماذج اللغات الضخمة!
أبحاث

اختيار مجموعات الموجهات دون إشراف: استراتيجيات جديدة لقياس أداء نماذج اللغات الضخمة!

أركايف للذكاءمنذ 2 شهر
👁 4
تحديات جديدة أمام نماذج التعلم العميق: MultiView-Bench يكشف عن عوائق دمج المشاهد المتعددة!
أبحاث

تحديات جديدة أمام نماذج التعلم العميق: MultiView-Bench يكشف عن عوائق دمج المشاهد المتعددة!

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة جديدة في نماذج اللغة: استكشاف صعوبة المهام الطويلة عبر معيار PredicateLongBench!
نماذج لغوية

ثورة جديدة في نماذج اللغة: استكشاف صعوبة المهام الطويلة عبر معيار PredicateLongBench!

أركايف للذكاءمنذ 2 شهر
👁 2
هل تفشل نماذج اللغة الكبيرة؟ اكتشافات مثيرة حول عيوب الأداء في الوكلاء الذكيين!
أبحاث

هل تفشل نماذج اللغة الكبيرة؟ اكتشافات مثيرة حول عيوب الأداء في الوكلاء الذكيين!

أركايف للذكاءمنذ 2 شهر
اكتشفوا قوة التفاعل الاجتماعي في نماذج الذكاء الاصطناعي من خلال SocialOmni!
أبحاث

اكتشفوا قوة التفاعل الاجتماعي في نماذج الذكاء الاصطناعي من خلال SocialOmni!

أركايف للذكاءمنذ 2 شهر
هل أنت مستعد لاكتشاف تصنيفات FFASR لمقياس دقة التعرف الصوتي؟
أبحاث

هل أنت مستعد لاكتشاف تصنيفات FFASR لمقياس دقة التعرف الصوتي؟

هاجينج فيسمنذ 2 شهر
👁 1
منصة TW-LegalBench: ثورة في قياس الفهم القانوني التايواني باستخدام الذكاء الاصطناعي
أبحاث

منصة TW-LegalBench: ثورة في قياس الفهم القانوني التايواني باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
EpiBench: معيار جديد لتقييم وكالات الذكاء الاصطناعي في تحليل الإيبيجينيوم
أبحاث

EpiBench: معيار جديد لتقييم وكالات الذكاء الاصطناعي في تحليل الإيبيجينيوم

أركايف للذكاءمنذ 3 شهر
الكشف عن فجوات الكفاءة في نماذج اللغات الضخمة: هل تنجح المعايير القياسية؟
أبحاث

الكشف عن فجوات الكفاءة في نماذج اللغات الضخمة: هل تنجح المعايير القياسية؟

أركايف للذكاءمنذ 3 شهر
👁 1
اكتشف السر وراء أداء نماذج الذكاء الاصطناعي: هل تعتمد على العوامل الخارجية أكثر من النموذج نفسه؟
أبحاث

اكتشف السر وراء أداء نماذج الذكاء الاصطناعي: هل تعتمد على العوامل الخارجية أكثر من النموذج نفسه؟

أركايف للذكاءمنذ 3 شهر
👁 1
تفكيك كفاءة التفكير في نماذج لغوية ضخمة: ما وراء دقة النتائج!
أبحاث

تفكيك كفاءة التفكير في نماذج لغوية ضخمة: ما وراء دقة النتائج!

أركايف للذكاءمنذ 3 شهر
👁 1
استكشاف متقدمة مراقبة المعرفة الذاتية في نماذج الذكاء الاصطناعي: معجم يحوي 33 نموذجاً ثورياً
أبحاث

استكشاف متقدمة مراقبة المعرفة الذاتية في نماذج الذكاء الاصطناعي: معجم يحوي 33 نموذجاً ثورياً

أركايف للذكاءمنذ 4 شهر
👁 1
معيار مبتكر لتقييم وكلاء الويب في مجالات التجارة الإلكترونية: نحو مستقبل أفضل!
أبحاث

معيار مبتكر لتقييم وكلاء الويب في مجالات التجارة الإلكترونية: نحو مستقبل أفضل!

أركايف للذكاءمنذ 4 شهر
👁 2