Ailoxa Logo

🏷️ #تقييم

379 مقال

ثورة في تقنيات التعلم غير المحدود: تقييم عملية النسيان في نماذج اللغة ذات الذاكرة المحدودة
أبحاث

ثورة في تقنيات التعلم غير المحدود: تقييم عملية النسيان في نماذج اللغة ذات الذاكرة المحدودة

أركايف للذكاءمنذ 2 شهر
كيف يمكن لتقنيات التقييم أن تقلل من تحيزات النماذج اللغوية الضخمة؟
أبحاث

كيف يمكن لتقنيات التقييم أن تقلل من تحيزات النماذج اللغوية الضخمة؟

أركايف للذكاءمنذ 2 شهر
👁 1
تحديات حماية حقوق الطبع والنشر في العصر الرقمي: تقييم إطار جديد باستخدام نماذج اللغات الضخمة!
أبحاث

تحديات حماية حقوق الطبع والنشر في العصر الرقمي: تقييم إطار جديد باستخدام نماذج اللغات الضخمة!

أركايف للذكاءمنذ 2 شهر
روبوست بانل: ثورة جديدة في تقييم نماذج الذكاء الاصطناعي!
أبحاث

روبوست بانل: ثورة جديدة في تقييم نماذج الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
تطور جديد في أمان نماذج الذكاء الاصطناعي: Introducing CASE-Bench!
أبحاث

تطور جديد في أمان نماذج الذكاء الاصطناعي: Introducing CASE-Bench!

أركايف للذكاءمنذ 2 شهر
👁 1
إعادة التفكير في تقييم دور اللعب: تقنيات جديدة لتجاوز قيود الشخصية
أبحاث

إعادة التفكير في تقييم دور اللعب: تقنيات جديدة لتجاوز قيود الشخصية

أركايف للذكاءمنذ 2 شهر
👁 1
ذاكرة مفككة: كيف تؤثر سلباً على أداء نماذج اللغة؟
نماذج لغوية

ذاكرة مفككة: كيف تؤثر سلباً على أداء نماذج اللغة؟

أركايف للذكاءمنذ 2 شهر
هل يمكن للذكاء الاصطناعي تقييم الإبداع البشري؟ تعرف على معيار الإبداع البشري!
أبحاث

هل يمكن للذكاء الاصطناعي تقييم الإبداع البشري؟ تعرف على معيار الإبداع البشري!

أركايف للذكاءمنذ 2 شهر
👁 1
DMind Benchmark: تقييم شامل لجهود نماذج اللغات الضخمة في عالم Web3
أبحاث

DMind Benchmark: تقييم شامل لجهود نماذج اللغات الضخمة في عالم Web3

أركايف للذكاءمنذ 2 شهر
👁 1
استخدم الأسئلة الثنائية لتحسين تقييم نماذج اللغات الضخمة: المشروع الثوري BINEVAL!
أبحاث

استخدم الأسئلة الثنائية لتحسين تقييم نماذج اللغات الضخمة: المشروع الثوري BINEVAL!

أركايف للذكاءمنذ 2 شهر
👁 1
WatchAct: الثورية في تقييم سلوك الروبوتات وطرق التلاعب
روبوتات

WatchAct: الثورية في تقييم سلوك الروبوتات وطرق التلاعب

أركايف للذكاءمنذ 2 شهر
👁 1
scBench-Long: الثورة في تقييمات علم الأحياء الخلوية على المدى الطويل!
أبحاث

scBench-Long: الثورة في تقييمات علم الأحياء الخلوية على المدى الطويل!

أركايف للذكاءمنذ 2 شهر
👁 1
كسر المرآة: التخفيف من انحياز التفضيل الذاتي في نماذج اللغة الكبيرة
أبحاث

كسر المرآة: التخفيف من انحياز التفضيل الذاتي في نماذج اللغة الكبيرة

أركايف للذكاءمنذ 2 شهر
تقييم مبتكر لتحسين توصيات الذكاء الاصطناعي لنماذج لغوية حول مرض السكري من النوع الثاني!
أبحاث

تقييم مبتكر لتحسين توصيات الذكاء الاصطناعي لنماذج لغوية حول مرض السكري من النوع الثاني!

أركايف للذكاءمنذ 2 شهر
👁 1
اكتشف درجاتك في الذكاء الاصطناعي مع إين ذا وييتس! 📊
أدوات

اكتشف درجاتك في الذكاء الاصطناعي مع إين ذا وييتس! 📊

تيك كرانشمنذ 2 شهر
👁 3
AURA: ابتكار ثوري في تصحيح قاضي الذكاء الاصطناعي من خلال فحص عدم اليقين
أبحاث

AURA: ابتكار ثوري في تصحيح قاضي الذكاء الاصطناعي من خلال فحص عدم اليقين

أركايف للذكاءمنذ 2 شهر
ثورة في تقييم نماذج اللغة: QMFOL تعيد تعريف المنطق الاستدلالي!
أبحاث

ثورة في تقييم نماذج اللغة: QMFOL تعيد تعريف المنطق الاستدلالي!

أركايف للذكاءمنذ 2 شهر
👁 1
شاهد كيف تغير RTSGameBench طريقة تقييم الذكاء الاستراتيجي في الألعاب!
أبحاث

شاهد كيف تغير RTSGameBench طريقة تقييم الذكاء الاستراتيجي في الألعاب!

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة في تقييم الملاحظات المجتمعية: نموذج متعدد الوكلاء يغيّر قواعد اللعبة!
أبحاث

ثورة في تقييم الملاحظات المجتمعية: نموذج متعدد الوكلاء يغيّر قواعد اللعبة!

أركايف للذكاءمنذ 2 شهر
WebSP-Eval: ثورة جديدة في تقييم أداء الوكلاء عبر الإنترنت في مهام الأمان والخصوصية!
أبحاث

WebSP-Eval: ثورة جديدة في تقييم أداء الوكلاء عبر الإنترنت في مهام الأمان والخصوصية!

أركايف للذكاءمنذ 2 شهر