Ailoxa Logo

🏷️ #التقييم

65 مقال

الذكاء الاصطناعي المتجسد: ثورة في بناء المعايير وآفاق مستقبلية مشوقة!
أبحاث

الذكاء الاصطناعي المتجسد: ثورة في بناء المعايير وآفاق مستقبلية مشوقة!

أركايف للذكاءمنذ 1 شهر
تعرف على $	au$-Rec: معيار موثوق لأنظمة التوصية الذكية!
أبحاث

تعرف على $ au$-Rec: معيار موثوق لأنظمة التوصية الذكية!

أركايف للذكاءمنذ 1 شهر
هل تستطيع نماذج اللغة الرؤية (VLMs) التفكير مثل المهندسين؟ تقييم شامل وتحديات جديدة!
أبحاث

هل تستطيع نماذج اللغة الرؤية (VLMs) التفكير مثل المهندسين؟ تقييم شامل وتحديات جديدة!

أركايف للذكاءمنذ 1 شهر
WeaveBench: منطلق اختبار شامل لوكلاء الحاسوب ذوي الواجهات الهجينة!
أبحاث

WeaveBench: منطلق اختبار شامل لوكلاء الحاسوب ذوي الواجهات الهجينة!

أركايف للذكاءمنذ 1 شهر
AVI-Bench: ثورة جديدة في الذكاء السمعي البصري للذكاء الاصطناعي!
أبحاث

AVI-Bench: ثورة جديدة في الذكاء السمعي البصري للذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
إطلاق SpatialWorld: معيار جديد لتقييم القدرة التفاعلية للذكاء الاصطناعي في المهام الواقعية!
أبحاث

إطلاق SpatialWorld: معيار جديد لتقييم القدرة التفاعلية للذكاء الاصطناعي في المهام الواقعية!

أركايف للذكاءمنذ 1 شهر
IMUG-Bench: معيار جديد لتقييم نماذج متعددة الوسائط في حوار تفاعلي مُعقد
أبحاث

IMUG-Bench: معيار جديد لتقييم نماذج متعددة الوسائط في حوار تفاعلي مُعقد

أركايف للذكاءمنذ 1 شهر
فكر سريعاً: تقدير أوقات إنجاز المهام للذكاء الاصطناعي المتطور بدون تفكير صريح!
أبحاث

فكر سريعاً: تقدير أوقات إنجاز المهام للذكاء الاصطناعي المتطور بدون تفكير صريح!

أركايف للذكاءمنذ 1 شهر
سبل جديدة في عالم الذكاء الاصطناعي: SentinelBench وتحدي المراقبة الطويلة الأمد
أبحاث

سبل جديدة في عالم الذكاء الاصطناعي: SentinelBench وتحدي المراقبة الطويلة الأمد

أركايف للذكاءمنذ 1 شهر
👁 1
طفرة جديدة في نماذج العالم: تقنية World Action Verifier تعيد تعريف الذكاء الاصطناعي
أبحاث

طفرة جديدة في نماذج العالم: تقنية World Action Verifier تعيد تعريف الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
👁 1
سير النظام الموحد: ثورة في إطار التجارب لفهم الكلام
أبحاث

سير النظام الموحد: ثورة في إطار التجارب لفهم الكلام

أركايف للذكاءمنذ 1 شهر
👁 2
إي-فالواتور: الأداة الثورية لتقييم موثوقية أنظمة الذكاء الاصطناعي
أدوات

إي-فالواتور: الأداة الثورية لتقييم موثوقية أنظمة الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
GPF-LiveNews: بروتوكول مثير لتقييم نماذج اللغة في إطار أحداث حية!
أبحاث

GPF-LiveNews: بروتوكول مثير لتقييم نماذج اللغة في إطار أحداث حية!

أركايف للذكاءمنذ 1 شهر
هل يمكن أن تجيب الأنظمة الذكية بشكل مختلف على نفس السؤال؟ اكتشفوا سر الاعتماد على المصادر المتعددة في الرعاية الصحية!
أبحاث

هل يمكن أن تجيب الأنظمة الذكية بشكل مختلف على نفس السؤال؟ اكتشفوا سر الاعتماد على المصادر المتعددة في الرعاية الصحية!

أركايف للذكاءمنذ 1 شهر
تحليل فعالية الاقتباسات: كيف يمكن تحسين دقة الإشارة في تقييم RAG
أبحاث

تحليل فعالية الاقتباسات: كيف يمكن تحسين دقة الإشارة في تقييم RAG

أركايف للذكاءمنذ 1 شهر
MatFormBench: الإطار الثوري لتقييم تصميم المواد المستهدف وتحسين الأداء
أبحاث

MatFormBench: الإطار الثوري لتقييم تصميم المواد المستهدف وتحسين الأداء

أركايف للذكاءمنذ 1 شهر
StakeBench: إطار ثوري لتقييم فهم اللغة على أساس التزام السوق!
أبحاث

StakeBench: إطار ثوري لتقييم فهم اللغة على أساس التزام السوق!

أركايف للذكاءمنذ 1 شهر
CityRep: معيار موحد لتقييم التمثيلات الحضرية عبر المدن والمهام والأساليب!
أبحاث

CityRep: معيار موحد لتقييم التمثيلات الحضرية عبر المدن والمهام والأساليب!

أركايف للذكاءمنذ 1 شهر
فهم ذاكرتنا الوكيلة: تحليل هياكلها وقيودها عبر دراسة شاملة
أبحاث

فهم ذاكرتنا الوكيلة: تحليل هياكلها وقيودها عبر دراسة شاملة

أركايف للذكاءمنذ 1 شهر
كوك سكيل: المعيار الثوري لقياس معالجة التسلسلات في الذكاء الاصطناعي
أبحاث

كوك سكيل: المعيار الثوري لقياس معالجة التسلسلات في الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
👁 1