🏷️ #معايير تقييم
55 مقال
أبحاث
JOR-Bench: تقييم أداء نماذج اللغات الضخمة في حل مشكلات البحوث التشغيلية باللغة اليابانية
أركايف للذكاءمنذ 7 ساعة
أبحاث
Vision2Web: معيار ثوري لتطوير المواقع الإلكترونية باستخدام الذكاء الاصطناعي!
أركايف للذكاءمنذ 7 ساعة
👁 1أبحاث
استكشف InvestPhilBench: المعيار الثوري لتقييم نماذج اللغات الكبيرة في فلسفة الاستثمار
أركايف للذكاءمنذ 11 يوم
👁 1أبحاث
تحليل جديد يكشف نقاط ضعف مثيرة في معايير تقييم البرمجة
مدونة أوبن إيه آيمنذ 12 يوم
أبحاث
تحديات الذكاء الاصطناعي: تقييم نماذج اللغة الضخمة ضمن تعقيدات البيانات الحقيقية
أركايف للذكاءمنذ 13 يوم
👁 1أبحاث
MMBench-Live: الثورة في تقييم النماذج متعددة الوسائط!
أركايف للذكاءمنذ 18 يوم
👁 4أبحاث
التقييم الزمني للذكاء الاصطناعي في فيديوهات الطب: تعرف على MedStreamBench!
أركايف للذكاءمنذ 18 يوم
👁 1أبحاث
GameDevBench: تقييم قدرات الوكلاء في تطوير الألعاب!
أركايف للذكاءمنذ 19 يوم
أبحاث
اكتشاف ثورة في الذكاء الاصطناعي مع EgoGapBench: معيار جديد لفهم الاختيار الإنساني في المشاهد متعددة الوكلاء!
أركايف للذكاءمنذ 19 يوم
أبحاث
DSH-Bench: معيار ثوري لتقييم توليد الصور من النصوص مع فهم عميق للموضوعات!
أركايف للذكاءمنذ 20 يوم
👁 2أبحاث
RigorBench: ثورة في قياس الانضباط العلمي لعملاء الذكاء الاصطناعي في البرمجة
أركايف للذكاءمنذ 20 يوم
👁 1أبحاث
MECoBench: طفرة جديدة في التعاون بين الوكلاء المُجسدين في بيئات متعددة الوسائط!
أركايف للذكاءمنذ 20 يوم
أبحاث
مؤشر جديد لكشف فشل نماذج الذكاء الاصطناعي في ضمان سلامة الرعاية الصحية!
أركايف للذكاءمنذ 21 يوم
👁 1روبوتات
سيرجفلا-بنش: أول معيار لتقييم نماذج الذكاء الاصطناعي في جراحة المنظار!
أركايف للذكاءمنذ 21 يوم
أبحاث
إطلاق SciVisAgentBench: منصة متطورة لتقييم وكلاء تحليل البيانات العلمية!
أركايف للذكاءمنذ 21 يوم
👁 1أدوات
ثورة جديدة في أدوات الجداول: كيف تقيم "SpreadsheetBench 2" فهم الوكالات لعمليات الأعمال المعقدة؟
أركايف للذكاءمنذ 21 يوم
👁 1أبحاث
استكشاف أفق طويل: كيف يمكن نماذج اللغة متعددة الوسائط التنبؤ بالمشاهد من منظور ذاتي؟
أركايف للذكاءمنذ 22 يوم
👁 1أبحاث
تحقيق ثورة في توليد الصور: معايير جديدة ومكافآت ديناميكية تُعيد تشكيل المستقبل!
أركايف للذكاءمنذ 25 يوم
👁 1أبحاث
اختراق ثوري في تصنيف الصور الطبية: هل يمكن للنموذج الكمومي تحسين MRI الدماغ؟
أركايف للذكاءمنذ 1 شهر
أبحاث
تعرف على SciRisk-Bench: معيار جديد لتقييم سلامة الذكاء الاصطناعي في الأبحاث العلمية!
أركايف للذكاءمنذ 1 شهر
👁 11 / 3التالي →
