Ailoxa Logo

🏷️ #تقييم الذكاء الاصطناعي

72 مقال

FATHOMS-RAG: إطار تقييم تفكير وملاحظة الأنظمة متعددة الوسائط باستخدام التكنولوجيا المتقدمة
أبحاث

FATHOMS-RAG: إطار تقييم تفكير وملاحظة الأنظمة متعددة الوسائط باستخدام التكنولوجيا المتقدمة

أركايف للذكاءمنذ 1 شهر
التحليل الذكي: ضمانات دقيقة لتقييم وكالات الذكاء الاصطناعي بدون توزيع
أبحاث

التحليل الذكي: ضمانات دقيقة لتقييم وكالات الذكاء الاصطناعي بدون توزيع

أركايف للذكاءمنذ 2 شهر
هل تقيمات الذكاء الاصطناعي فعالة؟ دعونا نتحدث عن الأسس العلمية!
أبحاث

هل تقيمات الذكاء الاصطناعي فعالة؟ دعونا نتحدث عن الأسس العلمية!

أركايف للذكاءمنذ 2 شهر
GVGAI-LLM: ثورة جديدة في تقييم نماذج اللغة الكبيرة من خلال الألعاب الفيديو!
أبحاث

GVGAI-LLM: ثورة جديدة في تقييم نماذج اللغة الكبيرة من خلال الألعاب الفيديو!

أركايف للذكاءمنذ 2 شهر
QSTRBench: معيار جديد لتقييم قدرة نماذج اللغة على التفكير المكاني والزماني النوعي!
أبحاث

QSTRBench: معيار جديد لتقييم قدرة نماذج اللغة على التفكير المكاني والزماني النوعي!

أركايف للذكاءمنذ 2 شهر
تقييم الذكاء الاصطناعي المفهومي: ثورة نوعية في قياس الإبداع البشري
أبحاث

تقييم الذكاء الاصطناعي المفهومي: ثورة نوعية في قياس الإبداع البشري

أركايف للذكاءمنذ 2 شهر
ثورة في تقييم الذكاء الاصطناعي: ProfBench وتحديات جديدة للذكاء الاصطناعي الخارق
أبحاث

ثورة في تقييم الذكاء الاصطناعي: ProfBench وتحديات جديدة للذكاء الاصطناعي الخارق

أركايف للذكاءمنذ 2 شهر
من الإرشادات إلى الضمانات: أدوات تقييم مبتكرة لاختبار نماذج اللغة المتخصصة
أبحاث

من الإرشادات إلى الضمانات: أدوات تقييم مبتكرة لاختبار نماذج اللغة المتخصصة

أركايف للذكاءمنذ 2 شهر
اكتشاف أبعاد جديدة: تقييم مسارات التفكير لوكلاء معززين بالأدوات
أبحاث

اكتشاف أبعاد جديدة: تقييم مسارات التفكير لوكلاء معززين بالأدوات

أركايف للذكاءمنذ 2 شهر
فخ التقييم: كيف تؤثر المعايير على فهم قدرات الذكاء الاصطناعي؟
أبحاث

فخ التقييم: كيف تؤثر المعايير على فهم قدرات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
إعادة تصور تقييم الرسوم البيانية الزمنية: الإطار الثوري المعتمد على الجاذبية!
أبحاث

إعادة تصور تقييم الرسوم البيانية الزمنية: الإطار الثوري المعتمد على الجاذبية!

أركايف للذكاءمنذ 2 شهر
الذكاء الاصطناعي عند حافة الانهيار الإحصائي: ثورة في تقييم التطبيقات التفاعلية!
أبحاث

الذكاء الاصطناعي عند حافة الانهيار الإحصائي: ثورة في تقييم التطبيقات التفاعلية!

أركايف للذكاءمنذ 2 شهر
REAP: كيف أحدثت ثورة في تقييم وكالات البرمجة باستخدام الذكاء الاصطناعي
أبحاث

REAP: كيف أحدثت ثورة في تقييم وكالات البرمجة باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
👁 1
PhyGround: تقييم الذكاء الاصطناعي في فهم الفيزياء بعالم الافتراضات!
أبحاث

PhyGround: تقييم الذكاء الاصطناعي في فهم الفيزياء بعالم الافتراضات!

أركايف للذكاءمنذ 2 شهر
👁 1
تعزيز التقييم الذاتي: كيف يغير VIGIL من فهمنا لوكالات الذكاء الاصطناعي؟
أبحاث

تعزيز التقييم الذاتي: كيف يغير VIGIL من فهمنا لوكالات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
👁 1
كيف تجعل تقييمات الذكاء الاصطناعي أكثر ملاءمة من خلال تحديد السياق؟
أبحاث

كيف تجعل تقييمات الذكاء الاصطناعي أكثر ملاءمة من خلال تحديد السياق؟

أركايف للذكاءمنذ 2 شهر
اكتشاف تنوع ردود الفعل في نماذج اللغة: بروتوكول مبتكر لتقييم تأثير سياق التقييم
أبحاث

اكتشاف تنوع ردود الفعل في نماذج اللغة: بروتوكول مبتكر لتقييم تأثير سياق التقييم

أركايف للذكاءمنذ 2 شهر
إعادة تعريف تقييم نماذج اللغة: إطار عمل يتجاوز الحدود الثابتة
أبحاث

إعادة تعريف تقييم نماذج اللغة: إطار عمل يتجاوز الحدود الثابتة

أركايف للذكاءمنذ 2 شهر
اكتشاف أفق جديد في تقييم الذكاء الاصطناعي: مفهوم توازن البطولات اللينة
أبحاث

اكتشاف أفق جديد في تقييم الذكاء الاصطناعي: مفهوم توازن البطولات اللينة

أركايف للذكاءمنذ 2 شهر
كيف تقيس الذكاء الاصطناعي؟ دليل شامل للباحثين حول تقييم التفكير في نماذج اللغة!
أبحاث

كيف تقيس الذكاء الاصطناعي؟ دليل شامل للباحثين حول تقييم التفكير في نماذج اللغة!

أركايف للذكاءمنذ 2 شهر