🏷️ #تقييم أداء
18 مقال
أبحاث
اكتشف HANDBOOK.md: معيار جديد لقياس أداء نماذج الذكاء الاصطناعي في اتباع التعليمات المطوّلة!
أركايف للذكاءمنذ 1 يوم
👁 1أبحاث
إطلاق ARCO: ثورة جديدة في تقييم أداء وكلاء الذكاء الاصطناعي!
أركايف للذكاءمنذ 6 يوم
أبحاث
اكتشاف SenWorld: ثورة في تقييم المساعدين الشخصيين من خلال محاكاة رقمية مبتكرة!
أركايف للذكاءمنذ 7 يوم
👁 1أبحاث
اختيار مجموعات الموجهات دون إشراف: استراتيجيات جديدة لقياس أداء نماذج اللغات الضخمة!
أركايف للذكاءمنذ 16 يوم
👁 3أبحاث
تحديات جديدة أمام نماذج التعلم العميق: MultiView-Bench يكشف عن عوائق دمج المشاهد المتعددة!
أركايف للذكاءمنذ 17 يوم
👁 1نماذج لغوية
ثورة جديدة في نماذج اللغة: استكشاف صعوبة المهام الطويلة عبر معيار PredicateLongBench!
أركايف للذكاءمنذ 20 يوم
👁 2أبحاث
هل تفشل نماذج اللغة الكبيرة؟ اكتشافات مثيرة حول عيوب الأداء في الوكلاء الذكيين!
أركايف للذكاءمنذ 22 يوم
أبحاث
اكتشفوا قوة التفاعل الاجتماعي في نماذج الذكاء الاصطناعي من خلال SocialOmni!
أركايف للذكاءمنذ 28 يوم
أبحاث
هل أنت مستعد لاكتشاف تصنيفات FFASR لمقياس دقة التعرف الصوتي؟
هاجينج فيسمنذ 1 شهر
أبحاث
منصة TW-LegalBench: ثورة في قياس الفهم القانوني التايواني باستخدام الذكاء الاصطناعي
أركايف للذكاءمنذ 1 شهر
أبحاث
EpiBench: معيار جديد لتقييم وكالات الذكاء الاصطناعي في تحليل الإيبيجينيوم
أركايف للذكاءمنذ 1 شهر
أبحاث
الكشف عن فجوات الكفاءة في نماذج اللغات الضخمة: هل تنجح المعايير القياسية؟
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
اكتشف السر وراء أداء نماذج الذكاء الاصطناعي: هل تعتمد على العوامل الخارجية أكثر من النموذج نفسه؟
أركايف للذكاءمنذ 2 شهر
أبحاث
تفكيك كفاءة التفكير في نماذج لغوية ضخمة: ما وراء دقة النتائج!
أركايف للذكاءمنذ 2 شهر
أبحاث
استكشاف متقدمة مراقبة المعرفة الذاتية في نماذج الذكاء الاصطناعي: معجم يحوي 33 نموذجاً ثورياً
أركايف للذكاءمنذ 2 شهر
أبحاث
تحليل متعمق: تقييم شديد الدقة لأنظمة الإجابة على الأسئلة الطبية وتأثيراتها على العدالة الصحية
أركايف للذكاءمنذ 3 شهر
أبحاث
معيار مبتكر لتقييم وكلاء الويب في مجالات التجارة الإلكترونية: نحو مستقبل أفضل!
أركايف للذكاءمنذ 3 شهر
أبحاث
استكشاف ثوري في تطوير نوى معالجة الذكاء الاصطناعي: آليات AscendKernelGen تتجاوز التحديات!
أركايف للذكاءمنذ 3 شهر
