🏷️ #معايير الأداء
17 مقال
أبحاث
اكتشاف قوة الذاكرة الطويلة في وكالات نماذج اللغة: تقييم تكاليف الأداء
أركايف للذكاءمنذ 3 يوم
أبحاث
تكنولوجيا رائدة: SingProbe تعيد تعريف حراسة وقت التشغيل لنماذج اللغات الضخمة!
أركايف للذكاءمنذ 12 يوم
👁 1أبحاث
نتكونفا أريناس: معيار تنفيذي مبتكر لقياس وكالات نماذج اللغة الكبيرة في تكوين الشبكات المغلقة
أركايف للذكاءمنذ 19 يوم
👁 1أبحاث
تحقيق أداء مذهل في تمييز الصوت: كيف نقيس تحسين المعايير؟
هاجينج فيسمنذ 23 يوم
👁 2أبحاث
التقييم الآلي لوكلاء اللغة الذكية: هل يمكن الاعتماد على نتائجها؟
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
إنفراس بنش: معيار جديد لتحسين استنتاجات نماذج اللغات الضخمة بواسطة وكلاء الذكاء الاصطناعي!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
مفاجأة في عالم الذكاء الاصطناعي: إطلاق SciCodePile، أكبر قاعدة بيانات للبرمجة العلمية!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
كشف الستار عن الاختلالات في تحليلات الجذور: تدقيق بروتوكول النتائج في معايير الأداء
أركايف للذكاءمنذ 2 شهر
👁 3أبحاث
Riemann-Bench: معيار جديد للذكاء الاصطناعي في الرياضيات المتقدمة
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
داكس: نموذج ثوري لتعلم تمثيلات علم الأمراض العامة عبر المقاييس
أركايف للذكاءمنذ 3 شهر
أبحاث
معايير الذكاء الاصطناعي في سلامة القيادة الذاتية: كيف يمكن تحسينها؟
أركايف للذكاءمنذ 3 شهر
أبحاث
تحديات قياس كفاءة الامتناع في الوكلاء المستقلين: لماذا تحتاج المعايير إلى تحديث؟
أركايف للذكاءمنذ 3 شهر
👁 2أبحاث
AgentKernelArena: معيار مبتكر لقياس كفاءة وكيل تحسين نوى GPU في عصر الذكاء الاصطناعي
أركايف للذكاءمنذ 3 شهر
أبحاث
استكشف معايير جديدة في توليد الفيديو: EntityBench ودورها في أحداث مرئية متسقة!
أركايف للذكاءمنذ 4 شهر
أبحاث
هل يمكن لمعايير الأداء للوكالات دعم نتائجها؟ اكتشف كيف يمكن لتحليل الأدلة تغيّر المفاهيم!
أركايف للذكاءمنذ 4 شهر
أبحاث
ثورة جديدة في الذكاء الاصطناعي: SREGym منصة معايير حقيقية لوكلاء SRE
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
EmoTrans: معيار جديد لفهم وتحليل التحولات العاطفية في نماذج اللغة متعددة الأبعاد
أركايف للذكاءمنذ 4 شهر
👁 1