Ailoxa Logo

🏷️ #تقييم

277 مقال

تقييم وكيل البحث في عالم متوازي: كيف نواجه تحديات الذكاء الاصطناعي؟
أبحاث

تقييم وكيل البحث في عالم متوازي: كيف نواجه تحديات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
👁 1
QEVA: المعيار الثوري لتقييم تلخيص الفيديوهات بلا مراجع
أبحاث

QEVA: المعيار الثوري لتقييم تلخيص الفيديوهات بلا مراجع

أركايف للذكاءمنذ 2 شهر
فيسكود بينش: ثورة في محاكاة المشاهد ثلاثية الأبعاد بفهم فيزيائي مبتكر!
أبحاث

فيسكود بينش: ثورة في محاكاة المشاهد ثلاثية الأبعاد بفهم فيزيائي مبتكر!

أركايف للذكاءمنذ 2 شهر
دراسة مثيرة: كيف تؤثر الهوية في تقييم نماذج الذكاء الاصطناعي متعدد الوكلاء؟
أبحاث

دراسة مثيرة: كيف تؤثر الهوية في تقييم نماذج الذكاء الاصطناعي متعدد الوكلاء؟

أركايف للذكاءمنذ 2 شهر
تعلم لغة بشكل مبتكر: إطار تعليمي شخصي مُعتمد على مناظرات الذكاء الاصطناعي!
أبحاث

تعلم لغة بشكل مبتكر: إطار تعليمي شخصي مُعتمد على مناظرات الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
STELLAR-E: ثورة جديدة في تقييم تطبيقات نماذج اللغات الضخمة!
أدوات

STELLAR-E: ثورة جديدة في تقييم تطبيقات نماذج اللغات الضخمة!

أركايف للذكاءمنذ 2 شهر
هل تهدد نماذج الذكاء الاصطناعي سلامة أبحاث الذكاء الاصطناعي؟
أبحاث

هل تهدد نماذج الذكاء الاصطناعي سلامة أبحاث الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
ثورة في تقييم الحقائق: اكتشاف أداة AtomEval لتحديد الفساد المعلوماتي
أبحاث

ثورة في تقييم الحقائق: اكتشاف أداة AtomEval لتحديد الفساد المعلوماتي

أركايف للذكاءمنذ 2 شهر
إعادة تشكيل التنسيق الطارئ في نماذج اللغات الكبيرة: إطار تقييم مبتكر على أرشيف MoltBook
أبحاث

إعادة تشكيل التنسيق الطارئ في نماذج اللغات الكبيرة: إطار تقييم مبتكر على أرشيف MoltBook

أركايف للذكاءمنذ 2 شهر
استراتيجيات ثورية لتقييم نماذج الذكاء الاصطناعي: مراجعة الأقران تضمن التميز!
نماذج لغوية

استراتيجيات ثورية لتقييم نماذج الذكاء الاصطناعي: مراجعة الأقران تضمن التميز!

أركايف للذكاءمنذ 2 شهر
MermaidSeqBench: معيار جديد لتقييم توليد مخططات التتابع من اللغة الطبيعية!
أبحاث

MermaidSeqBench: معيار جديد لتقييم توليد مخططات التتابع من اللغة الطبيعية!

أركايف للذكاءمنذ 2 شهر
نحو تقييم شامل لنماذج الصوت واللغة: استعراض كامل للتطورات المستقبلية!
أبحاث

نحو تقييم شامل لنماذج الصوت واللغة: استعراض كامل للتطورات المستقبلية!

أركايف للذكاءمنذ 2 شهر
👁 1
إعادة تفكير في تقييم الذكاء الاصطناعي القابل للتفسير: تدقيق إنساني لقيم شابلي في البيئات عالية المخاطر
أبحاث

إعادة تفكير في تقييم الذكاء الاصطناعي القابل للتفسير: تدقيق إنساني لقيم شابلي في البيئات عالية المخاطر

أركايف للذكاءمنذ 2 شهر
👁 2
إعادة التفكير في تقييم التفكير الرياضي: إطار عمل قوي لتقييم النماذج اللغوية الكبيرة
أبحاث

إعادة التفكير في تقييم التفكير الرياضي: إطار عمل قوي لتقييم النماذج اللغوية الكبيرة

أركايف للذكاءمنذ 2 شهر
OpenEstimate: ثورة في تقييم نماذج الذكاء الاصطناعي في مواجهة عدم اليقين!
أبحاث

OpenEstimate: ثورة في تقييم نماذج الذكاء الاصطناعي في مواجهة عدم اليقين!

أركايف للذكاءمنذ 2 شهر
ابتكار نظام تقييم مبتكر لتلخيص الاجتماعات باستخدام الذكاء الاصطناعي: تفاصيل مثيرة!
أبحاث

ابتكار نظام تقييم مبتكر لتلخيص الاجتماعات باستخدام الذكاء الاصطناعي: تفاصيل مثيرة!

أركايف للذكاءمنذ 2 شهر
👁 1
تجاوز فخ الاتفاق: إشارات الدفاع لتقييم الذكاء الاصطناعي القائم على القوانين
أبحاث

تجاوز فخ الاتفاق: إشارات الدفاع لتقييم الذكاء الاصطناعي القائم على القوانين

أركايف للذكاءمنذ 2 شهر
CyberCertBench: أداة مبتكرة لتقييم مهارات نماذج اللغة في أمن المعلومات
أبحاث

CyberCertBench: أداة مبتكرة لتقييم مهارات نماذج اللغة في أمن المعلومات

أركايف للذكاءمنذ 3 شهر
OMIBench: ثورة في تقييم القدرة الاستدلالية للنماذج البصرية اللغوية المتقدمة!
أبحاث

OMIBench: ثورة في تقييم القدرة الاستدلالية للنماذج البصرية اللغوية المتقدمة!

أركايف للذكاءمنذ 3 شهر
تسليط الضوء على تأثيرات النماذج اللغوية الضخمة: إطار شفاف لتقدير الأداء
أبحاث

تسليط الضوء على تأثيرات النماذج اللغوية الضخمة: إطار شفاف لتقدير الأداء

أركايف للذكاءمنذ 3 شهر