Ailoxa Logo

🏷️ #تقييم

273 مقال

ثورة جديدة في الذكاء الاصطناعي: أداة RuBench للتقييم الذكي بلغة روسية!
أبحاث

ثورة جديدة في الذكاء الاصطناعي: أداة RuBench للتقييم الذكي بلغة روسية!

أركايف للذكاءمنذ 13 يوم
👁 1
نموذج حواري مبتكر: تقييم تلقائي لحوارات الإرشاد باللغة اليابانية باستخدام الذكاء الاصطناعي
أبحاث

نموذج حواري مبتكر: تقييم تلقائي لحوارات الإرشاد باللغة اليابانية باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 14 يوم
👁 1
RoboDojo: معيار ثوري لتقييم أداء الروبوتات في العالم الافتراضي والواقعي!
روبوتات

RoboDojo: معيار ثوري لتقييم أداء الروبوتات في العالم الافتراضي والواقعي!

أركايف للذكاءمنذ 14 يوم
ثورة جديدة في تقييم الذكاء الاصطناعي: كيف يعمل BoRP على تحسين رضا المستخدمين؟
أبحاث

ثورة جديدة في تقييم الذكاء الاصطناعي: كيف يعمل BoRP على تحسين رضا المستخدمين؟

أركايف للذكاءمنذ 14 يوم
👁 1
فجوة تقييم الذكاء الاصطناعي في السياسة الخارجية: تحديات جديدة أمام حكومات الذكاء الاصطناعي!
أبحاث

فجوة تقييم الذكاء الاصطناعي في السياسة الخارجية: تحديات جديدة أمام حكومات الذكاء الاصطناعي!

أركايف للذكاءمنذ 14 يوم
AgenticDataBench: المرجع الشامل لوكلاء البيانات الثورية!
أبحاث

AgenticDataBench: المرجع الشامل لوكلاء البيانات الثورية!

أركايف للذكاءمنذ 18 يوم
👁 1
تحديات وتوصيات لاستخدام نماذج الذكاء الاصطناعي كقضاة في التقييمات متعددة اللغات
أبحاث

تحديات وتوصيات لاستخدام نماذج الذكاء الاصطناعي كقضاة في التقييمات متعددة اللغات

أركايف للذكاءمنذ 18 يوم
ثورة جديدة في فهم الملفات المكتبية: اختبار Office Comprehension Benchmark!
نماذج لغوية

ثورة جديدة في فهم الملفات المكتبية: اختبار Office Comprehension Benchmark!

أركايف للذكاءمنذ 18 يوم
اختبار الطيران: معيار ثوري لتقييم نماذج الذكاء الاصطناعي في قطاع الطيران
أبحاث

اختبار الطيران: معيار ثوري لتقييم نماذج الذكاء الاصطناعي في قطاع الطيران

أركايف للذكاءمنذ 18 يوم
👁 1
دراسة جديدة تكشف: كيف تؤثر إطارات المطالبات على تقييم أداء نماذج الذكاء الاصطناعي في الكشف عن الأخطاء!
أبحاث

دراسة جديدة تكشف: كيف تؤثر إطارات المطالبات على تقييم أداء نماذج الذكاء الاصطناعي في الكشف عن الأخطاء!

أركايف للذكاءمنذ 18 يوم
👁 1
MindEdit-Bench: معيار جديد لتقييم قدرة نماذج اللغة والرؤية على التفكير المكاني النقدي
أبحاث

MindEdit-Bench: معيار جديد لتقييم قدرة نماذج اللغة والرؤية على التفكير المكاني النقدي

أركايف للذكاءمنذ 19 يوم
ثورة في تقنيات التعلم غير المحدود: تقييم عملية النسيان في نماذج اللغة ذات الذاكرة المحدودة
أبحاث

ثورة في تقنيات التعلم غير المحدود: تقييم عملية النسيان في نماذج اللغة ذات الذاكرة المحدودة

أركايف للذكاءمنذ 19 يوم
سيفورا: إطار تقييم التعليقات ودعم الكتابة للطلاب باستخدام الذكاء الاصطناعي
أبحاث

سيفورا: إطار تقييم التعليقات ودعم الكتابة للطلاب باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 19 يوم
👁 1
AGI Maze: الإطار المثالي لتقييم وكالات نمذجة العالم!
أبحاث

AGI Maze: الإطار المثالي لتقييم وكالات نمذجة العالم!

أركايف للذكاءمنذ 19 يوم
👁 1
تقييم سلامة الذكاء الاصطناعي: منهجية جديدة لاختبار سلوك النماذج اللغوية!
أبحاث

تقييم سلامة الذكاء الاصطناعي: منهجية جديدة لاختبار سلوك النماذج اللغوية!

أركايف للذكاءمنذ 19 يوم
تحديات حماية حقوق الطبع والنشر في العصر الرقمي: تقييم إطار جديد باستخدام نماذج اللغات الضخمة!
أبحاث

تحديات حماية حقوق الطبع والنشر في العصر الرقمي: تقييم إطار جديد باستخدام نماذج اللغات الضخمة!

أركايف للذكاءمنذ 20 يوم
كيف يمكن لتقنيات التقييم أن تقلل من تحيزات النماذج اللغوية الضخمة؟
أبحاث

كيف يمكن لتقنيات التقييم أن تقلل من تحيزات النماذج اللغوية الضخمة؟

أركايف للذكاءمنذ 20 يوم
روبوست بانل: ثورة جديدة في تقييم نماذج الذكاء الاصطناعي!
أبحاث

روبوست بانل: ثورة جديدة في تقييم نماذج الذكاء الاصطناعي!

أركايف للذكاءمنذ 20 يوم
تطور جديد في أمان نماذج الذكاء الاصطناعي: Introducing CASE-Bench!
أبحاث

تطور جديد في أمان نماذج الذكاء الاصطناعي: Introducing CASE-Bench!

أركايف للذكاءمنذ 21 يوم
إعادة التفكير في تقييم دور اللعب: تقنيات جديدة لتجاوز قيود الشخصية
أبحاث

إعادة التفكير في تقييم دور اللعب: تقنيات جديدة لتجاوز قيود الشخصية

أركايف للذكاءمنذ 21 يوم