🏷️ #تقييم
379 مقال
أبحاث
تعلم لغة بشكل مبتكر: إطار تعليمي شخصي مُعتمد على مناظرات الذكاء الاصطناعي!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
هل تهدد نماذج الذكاء الاصطناعي سلامة أبحاث الذكاء الاصطناعي؟
أركايف للذكاءمنذ 4 شهر
أدوات
STELLAR-E: ثورة جديدة في تقييم تطبيقات نماذج اللغات الضخمة!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
تقييم رحلات المدن المستدامة: الذكاء الاصطناعي كقاضي وضرورة التعاون البشري!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
QEVA: المعيار الثوري لتقييم تلخيص الفيديوهات بلا مراجع
أركايف للذكاءمنذ 4 شهر
أبحاث
تقييم وكيل البحث في عالم متوازي: كيف نواجه تحديات الذكاء الاصطناعي؟
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
ثورة في تقييم الحقائق: اكتشاف أداة AtomEval لتحديد الفساد المعلوماتي
أركايف للذكاءمنذ 4 شهر
أبحاث
إعادة تشكيل التنسيق الطارئ في نماذج اللغات الكبيرة: إطار تقييم مبتكر على أرشيف MoltBook
أركايف للذكاءمنذ 4 شهر
👁 1نماذج لغوية
استراتيجيات ثورية لتقييم نماذج الذكاء الاصطناعي: مراجعة الأقران تضمن التميز!
أركايف للذكاءمنذ 4 شهر
أبحاث
MermaidSeqBench: معيار جديد لتقييم توليد مخططات التتابع من اللغة الطبيعية!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
نحو تقييم شامل لنماذج الصوت واللغة: استعراض كامل للتطورات المستقبلية!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
ماركت بنش: تقييم وكلاء الذكاء الاصطناعي كمتعاملين في الأسواق
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
كيف يمكن لقضاة الذكاء الاصطناعي أن يتجاوزوا التحيز؟ دراسة شاملة لاستراتيجيات التخفيف من التحيز في نماذج القضاة!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
فيسكود بينش: ثورة في محاكاة المشاهد ثلاثية الأبعاد بفهم فيزيائي مبتكر!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
إعادة التفكير في تقييم التفكير الرياضي: إطار عمل قوي لتقييم النماذج اللغوية الكبيرة
أركايف للذكاءمنذ 4 شهر
أبحاث
إعادة تفكير في تقييم الذكاء الاصطناعي القابل للتفسير: تدقيق إنساني لقيم شابلي في البيئات عالية المخاطر
أركايف للذكاءمنذ 4 شهر
👁 2أبحاث
ابتكار نظام تقييم مبتكر لتلخيص الاجتماعات باستخدام الذكاء الاصطناعي: تفاصيل مثيرة!
أركايف للذكاءمنذ 4 شهر
👁 1أبحاث
OpenEstimate: ثورة في تقييم نماذج الذكاء الاصطناعي في مواجهة عدم اليقين!
أركايف للذكاءمنذ 4 شهر
أبحاث
تجاوز فخ الاتفاق: إشارات الدفاع لتقييم الذكاء الاصطناعي القائم على القوانين
أركايف للذكاءمنذ 4 شهر
أبحاث
OMIBench: ثورة في تقييم القدرة الاستدلالية للنماذج البصرية اللغوية المتقدمة!
أركايف للذكاءمنذ 4 شهر
👁 1