Ailoxa Logo

🏷️ #تقييم

379 مقال

اكتشاف قوة الذكاء الاصطناعي: تقييم التفاعل والتفكير في نماذج اللغات الضخمة
أبحاث

اكتشاف قوة الذكاء الاصطناعي: تقييم التفاعل والتفكير في نماذج اللغات الضخمة

أركايف للذكاءمنذ 3 شهر
👁 3
إطار تقييم قائم على الشخصيات لتحقيق التوافق المتعدد في الذكاء الاصطناعي التوليدي
أبحاث

إطار تقييم قائم على الشخصيات لتحقيق التوافق المتعدد في الذكاء الاصطناعي التوليدي

أركايف للذكاءمنذ 3 شهر
👁 1
إصلاح طرق تقييم تمثيلات تخطيط القلب الكهربائي: خطوة نحو تحسين دقة البيانات السريرية!
أبحاث

إصلاح طرق تقييم تمثيلات تخطيط القلب الكهربائي: خطوة نحو تحسين دقة البيانات السريرية!

أركايف للذكاءمنذ 3 شهر
👁 1
ثورة في تقييم الذكاء الاصطناعي: كيف يمكن لنموذج LLM أن يصبح قاضياً موثوقاً؟
أبحاث

ثورة في تقييم الذكاء الاصطناعي: كيف يمكن لنموذج LLM أن يصبح قاضياً موثوقاً؟

أركايف للذكاءمنذ 3 شهر
👁 1
ثورة في علم الأحياء: تقييم الكيانات الحيوية بمساعدة الذكاء الاصطناعي
أبحاث

ثورة في علم الأحياء: تقييم الكيانات الحيوية بمساعدة الذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر
👁 2
ثورة في تقييم الذكاء الاصطناعي السريري: اكتشافات جديدة تكشف عن إمكانيات خفية!
أبحاث

ثورة في تقييم الذكاء الاصطناعي السريري: اكتشافات جديدة تكشف عن إمكانيات خفية!

أركايف للذكاءمنذ 3 شهر
👁 1
TRACE: تقييم عملية التفكير المنطقي في نماذج اللغة الكبيرة بطريقة جديدة!
نماذج لغوية

TRACE: تقييم عملية التفكير المنطقي في نماذج اللغة الكبيرة بطريقة جديدة!

أركايف للذكاءمنذ 3 شهر
JMed48k: المعيار الثوري لاختبار الترخيص الطبي في اليابان يقيّم نماذج الرؤية واللغة
أبحاث

JMed48k: المعيار الثوري لاختبار الترخيص الطبي في اليابان يقيّم نماذج الرؤية واللغة

أركايف للذكاءمنذ 3 شهر
قياس تمكين وكلاء نماذج اللغة: كيف يسهم الذكاء الاصطناعي في تعزيز الأداء الفعّال؟
أبحاث

قياس تمكين وكلاء نماذج اللغة: كيف يسهم الذكاء الاصطناعي في تعزيز الأداء الفعّال؟

أركايف للذكاءمنذ 3 شهر
SCDBench: معيار ثوري لفحص أدوات فك تجميع العقود الذكية المدعومة بالذكاء الاصطناعي
أبحاث

SCDBench: معيار ثوري لفحص أدوات فك تجميع العقود الذكية المدعومة بالذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر
مغامرات العقل: ساحة جديدة لتقييم التفكير الاجتماعي والاستراتيجي في نماذج اللغة المتعددة العملاء!
أبحاث

مغامرات العقل: ساحة جديدة لتقييم التفكير الاجتماعي والاستراتيجي في نماذج اللغة المتعددة العملاء!

أركايف للذكاءمنذ 3 شهر
معيار جديد لتقييم أنظمة الذكاء الاصطناعي! استكشف كيف يتم قياس كفاءة نماذج اللغات الضخمة كحكام
أبحاث

معيار جديد لتقييم أنظمة الذكاء الاصطناعي! استكشف كيف يتم قياس كفاءة نماذج اللغات الضخمة كحكام

أركايف للذكاءمنذ 3 شهر
👁 1
إطار RAGe: ثورة في تقييم تطبيقات الذكاء الاصطناعي المعززة بالاسترجاع
أدوات

إطار RAGe: ثورة في تقييم تطبيقات الذكاء الاصطناعي المعززة بالاسترجاع

أركايف للذكاءمنذ 3 شهر
لماذا يجب على مجتمع الذكاء الاصطناعي التخلي عن مصطلح "الباب الخلفي الإيجابي"؟
أخلاقيات الذكاء الاصطناعي

لماذا يجب على مجتمع الذكاء الاصطناعي التخلي عن مصطلح "الباب الخلفي الإيجابي"؟

أركايف للذكاءمنذ 3 شهر
كيف تعيد الذكاء الاصطناعي تشكيل التعليم العالي؟ نموذج رياضي لفهم الاستخدام الأخلاقي!
أخلاقيات الذكاء الاصطناعي

كيف تعيد الذكاء الاصطناعي تشكيل التعليم العالي؟ نموذج رياضي لفهم الاستخدام الأخلاقي!

أركايف للذكاءمنذ 3 شهر
👁 1
MIRA: معايير مبتكرة لتحسين دقة المعلومات الطبية عبر اللغات
أبحاث

MIRA: معايير مبتكرة لتحسين دقة المعلومات الطبية عبر اللغات

أركايف للذكاءمنذ 3 شهر
ابتكار إطار موحد لتقييم قدرات الوكلاء في نماذج اللغات الضخمة
أبحاث

ابتكار إطار موحد لتقييم قدرات الوكلاء في نماذج اللغات الضخمة

أركايف للذكاءمنذ 3 شهر
👁 1
فجوة المراقبة والتحكم: لماذا لا تكفي نماذج الذكاء الاصطناعي لاستجابة فعالة
أبحاث

فجوة المراقبة والتحكم: لماذا لا تكفي نماذج الذكاء الاصطناعي لاستجابة فعالة

أركايف للذكاءمنذ 3 شهر
ثورة جديدة في الذكاء الاصطناعي: تقييم واقعية الفيزياء في نماذج الفيديو من النصوص!
أبحاث

ثورة جديدة في الذكاء الاصطناعي: تقييم واقعية الفيزياء في نماذج الفيديو من النصوص!

أركايف للذكاءمنذ 3 شهر
TowerMind: بيئة جديدة للألعاب الدفاعية تثبت قوة نماذج اللغات الكبيرة كعملاء ذكيين!
أبحاث

TowerMind: بيئة جديدة للألعاب الدفاعية تثبت قوة نماذج اللغات الكبيرة كعملاء ذكيين!

أركايف للذكاءمنذ 3 شهر