Ailoxa Logo

🏷️ #تقييم

379 مقال

آفاق جديدة: تدقيق الدقة التجريبية في الأبحاث العلمية المدعومة بنماذج اللغات الضخمة
أبحاث

آفاق جديدة: تدقيق الدقة التجريبية في الأبحاث العلمية المدعومة بنماذج اللغات الضخمة

أركايف للذكاءمنذ 8 يوم
👁 1
المؤشر النضجي للأنماط: معيار جديد لتقييم قدرات النماذج المتعددة الوسائط
أبحاث

المؤشر النضجي للأنماط: معيار جديد لتقييم قدرات النماذج المتعددة الوسائط

أركايف للذكاءمنذ 8 يوم
👁 2
ثورة في التصميم الداخلي: معيار MatReplace لتحسين استبدال المواد بدون مرجع
أبحاث

ثورة في التصميم الداخلي: معيار MatReplace لتحسين استبدال المواد بدون مرجع

أركايف للذكاءمنذ 10 يوم
نموذج بايزي موحد لتقييم أنظمة التوليد المعزز بالاسترجاع: كيف يحدث التقييم الفعال؟
أبحاث

نموذج بايزي موحد لتقييم أنظمة التوليد المعزز بالاسترجاع: كيف يحدث التقييم الفعال؟

أركايف للذكاءمنذ 10 يوم
اكتشاف جديد: قياس حساسية نماذج اللغة الكبيرة تجاه النفاق الاجتماعي!
أبحاث

اكتشاف جديد: قياس حساسية نماذج اللغة الكبيرة تجاه النفاق الاجتماعي!

أركايف للذكاءمنذ 10 يوم
👁 1
استكشاف قوة نماذج اللغة: كيفية تقييم توليدها المتعدد بدقة!
أبحاث

استكشاف قوة نماذج اللغة: كيفية تقييم توليدها المتعدد بدقة!

أركايف للذكاءمنذ 10 يوم
👁 1
ثورة في تقييم النص إلى صورة: الإطار الجديد QC-T2I-Bench يُحدّد الإنجازات بدقة مذهلة!
أبحاث

ثورة في تقييم النص إلى صورة: الإطار الجديد QC-T2I-Bench يُحدّد الإنجازات بدقة مذهلة!

أركايف للذكاءمنذ 10 يوم
👁 2
هل يمكن للذكاء الاصطناعي تحقيق العدالة القانونية؟ اختبار بروتوكول القاضي المزدوج لنماذج الرؤية واللغة!
أبحاث

هل يمكن للذكاء الاصطناعي تحقيق العدالة القانونية؟ اختبار بروتوكول القاضي المزدوج لنماذج الرؤية واللغة!

أركايف للذكاءمنذ 10 يوم
👁 1
ثورة تقييم الوكلاء الصوتيين: كيف يمكن للذكاء الاصطناعي قياس الجودة بدقة؟
أبحاث

ثورة تقييم الوكلاء الصوتيين: كيف يمكن للذكاء الاصطناعي قياس الجودة بدقة؟

أركايف للذكاءمنذ 10 يوم
👁 1
تحليل شامل: كيفية تقييم نماذج الذكاء الاصطناعي كقضاة وأهمية صلاحية البناء
أبحاث

تحليل شامل: كيفية تقييم نماذج الذكاء الاصطناعي كقضاة وأهمية صلاحية البناء

أركايف للذكاءمنذ 10 يوم
منظومة LitReview Arena: تقييم مبدع لمراجعات الأدب بأسلوب المواجهة
أبحاث

منظومة LitReview Arena: تقييم مبدع لمراجعات الأدب بأسلوب المواجهة

أركايف للذكاءمنذ 11 يوم
👁 1
عيادات توائم رقمية تساعد في تقييم الذكاء الاصطناعي في البيئات السريرية
أبحاث

عيادات توائم رقمية تساعد في تقييم الذكاء الاصطناعي في البيئات السريرية

أركايف للذكاءمنذ 11 يوم
👁 2
استبيان مبتكر لتقييم معرفة الطلاب بالذكاء الاصطناعي: خطوة نحو تعليم أفضل!
أبحاث

استبيان مبتكر لتقييم معرفة الطلاب بالذكاء الاصطناعي: خطوة نحو تعليم أفضل!

أركايف للذكاءمنذ 11 يوم
👁 1
تحليل هجمات الهلوسة في أكواد LLM: استراتيجيات مبتكرة للدفاع في زمن الاستدلال
أبحاث

تحليل هجمات الهلوسة في أكواد LLM: استراتيجيات مبتكرة للدفاع في زمن الاستدلال

أركايف للذكاءمنذ 11 يوم
👁 1
إحداث ثورة في التعليم: بيانات امتحانات متعددة الوسائط لتقييم عادل وفعّال
أبحاث

إحداث ثورة في التعليم: بيانات امتحانات متعددة الوسائط لتقييم عادل وفعّال

أركايف للذكاءمنذ 11 يوم
ثورة في تقييم نماذج الذكاء الاصطناعي: كيفية اختبار أفكار البحث بدقة!
أبحاث

ثورة في تقييم نماذج الذكاء الاصطناعي: كيفية اختبار أفكار البحث بدقة!

أركايف للذكاءمنذ 11 يوم
ثورة في تقييم أنظمة استخراج المعرفة: TRIAD يعيد تعريف إعداد البيانات!
أبحاث

ثورة في تقييم أنظمة استخراج المعرفة: TRIAD يعيد تعريف إعداد البيانات!

أركايف للذكاءمنذ 11 يوم
👁 1
تحليل مثير: تأثير الحساسيات في تقييم نماذج اللغات الضخمة على نتائج الصدارة!
أبحاث

تحليل مثير: تأثير الحساسيات في تقييم نماذج اللغات الضخمة على نتائج الصدارة!

أركايف للذكاءمنذ 11 يوم
👁 1
فليفر بنش: تصنيف نماذج اللغات الرائدة باستخدام حقائق طهو قابلة للتنفيذ
نماذج لغوية

فليفر بنش: تصنيف نماذج اللغات الرائدة باستخدام حقائق طهو قابلة للتنفيذ

أركايف للذكاءمنذ 12 يوم
👁 1
اكتشاف الأسماء المجهولة: ثورة في تقييم نماذج اللغات الضخمة!
أبحاث

اكتشاف الأسماء المجهولة: ثورة في تقييم نماذج اللغات الضخمة!

أركايف للذكاءمنذ 12 يوم
👁 2