🏷️ #المعايير
7 مقال
أبحاث
هل تعاني الوكلاء الذكاء الاصطناعي من المديح المفرط؟ اكتشفوا قياسات سلوكهم الإيجابي المستدام!
أركايف للذكاءمنذ 20 يوم
👁 1أبحاث
SWE-Marathon: هل يمكن للذكاء الاصطناعي إكمال مهام تطوير البرمجيات المعقدة بشكل مستقل؟
أركايف للذكاءمنذ 1 شهر
أبحاث
AutoLab: معيار جديد لإجراء أبحاث وهندسة السيارات على المدى الطويل
أركايف للذكاءمنذ 2 شهر
👁 1نماذج لغوية
أحدث ابتكارات الذكاء الاصطناعي: RoleCDE لتحسين أداء الوكلاء في الأدوار! 🚀
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
VT-Bench: المعيار الثوري لتعلم البيانات المرئية والجدولية متعدد النماذج!
أركايف للذكاءمنذ 2 شهر
أبحاث
LithoBench: ثورة في تفسير طبقات الصخور عبر النماذج المتعددة الأنماط
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشاف AgentFloor: إلى أي مدى يمكن لنماذج الذكاء الاصطناعي الصغيرة التقدم في استخدام الأدوات؟
أركايف للذكاءمنذ 3 شهر
