Ailoxa Logo

🏷️ #تقييم

275 مقال

سورج: إطار تقييم جديد لتحسين توليد الاستبيانات العلمية
أبحاث

سورج: إطار تقييم جديد لتحسين توليد الاستبيانات العلمية

أركايف للذكاءمنذ 2 شهر
هل يمكنك الوثوق بالاستثمارات المدعومة بالذكاء الاصطناعي؟ تعرف على قيمة ValueBlindBench!
أبحاث

هل يمكنك الوثوق بالاستثمارات المدعومة بالذكاء الاصطناعي؟ تعرف على قيمة ValueBlindBench!

أركايف للذكاءمنذ 2 شهر
اكتشاف الحدود: منصة oMeBench لقياس قدرة نماذج اللغة في فهم آليات التفاعلات العضوية
أبحاث

اكتشاف الحدود: منصة oMeBench لقياس قدرة نماذج اللغة في فهم آليات التفاعلات العضوية

أركايف للذكاءمنذ 2 شهر
ثورة تقييم الذكاء الاصطناعي: المبادئ التوجيهية لتجارب التحكم العشوائي
أبحاث

ثورة تقييم الذكاء الاصطناعي: المبادئ التوجيهية لتجارب التحكم العشوائي

أركايف للذكاءمنذ 2 شهر
👁 1
إطلاق إطار CLEAR: كيف تؤثر الضوضاء والغموض على موثوقية النماذج اللغوية الكبيرة في الطب؟
أبحاث

إطلاق إطار CLEAR: كيف تؤثر الضوضاء والغموض على موثوقية النماذج اللغوية الكبيرة في الطب؟

أركايف للذكاءمنذ 2 شهر
مغامرة الذاكرة الذكية: تعرف على بروتوكول MEMAUDIT الثوري لتقييم الكتابة الطويلة الأمد!
أبحاث

مغامرة الذاكرة الذكية: تعرف على بروتوكول MEMAUDIT الثوري لتقييم الكتابة الطويلة الأمد!

أركايف للذكاءمنذ 2 شهر
اكتشاف الذكاء الاصطناعي الوكّي: ثغرات ومخاطر تتطلب إطار تقييم مبتكر!
أبحاث

اكتشاف الذكاء الاصطناعي الوكّي: ثغرات ومخاطر تتطلب إطار تقييم مبتكر!

أركايف للذكاءمنذ 2 شهر
👁 1
من المختبر إلى العالم الحقيقي: تقييم التفكير البرمجي في مستوى المستودع
أبحاث

من المختبر إلى العالم الحقيقي: تقييم التفكير البرمجي في مستوى المستودع

أركايف للذكاءمنذ 2 شهر
مؤشر GR-Ben: ثورة في تقييم نماذج المكافآت العملية في الذكاء الاصطناعي
أبحاث

مؤشر GR-Ben: ثورة في تقييم نماذج المكافآت العملية في الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
اكتشاف إمكانيات الذكاء الاصطناعي: MCP-Atlas يرفع مستوى الكفاءة في استخدام الأدوات
أبحاث

اكتشاف إمكانيات الذكاء الاصطناعي: MCP-Atlas يرفع مستوى الكفاءة في استخدام الأدوات

أركايف للذكاءمنذ 2 شهر
FinChain: المعلم الرمزي الجديد في تقييم التحليل المالي القابل للتحقق
أبحاث

FinChain: المعلم الرمزي الجديد في تقييم التحليل المالي القابل للتحقق

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة التعليم: تقييم نماذج اللغة متعددة الوسائط لحل مشكلات طلاب STEM في الجامعات
أبحاث

ثورة التعليم: تقييم نماذج اللغة متعددة الوسائط لحل مشكلات طلاب STEM في الجامعات

أركايف للذكاءمنذ 2 شهر
اكتشف Auto-ARGUE: ثورة جديدة في تقييم توليد التقارير المعتمدة على الذكاء الاصطناعي!
أبحاث

اكتشف Auto-ARGUE: ثورة جديدة في تقييم توليد التقارير المعتمدة على الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
إعادة التفكير في معايير الذكاء الاصطناعي في الرعاية الصحية: إطار MedCheck الثوري!
أبحاث

إعادة التفكير في معايير الذكاء الاصطناعي في الرعاية الصحية: إطار MedCheck الثوري!

أركايف للذكاءمنذ 2 شهر
كيف تُغير نماذج اللغة الذكية طريقة تقييم الرياضيات؟ اكتشاف أخطاء تقييم التعلم بالإصلاح المفرط!
أبحاث

كيف تُغير نماذج اللغة الذكية طريقة تقييم الرياضيات؟ اكتشاف أخطاء تقييم التعلم بالإصلاح المفرط!

أركايف للذكاءمنذ 2 شهر
👁 1
كيف يمكن لقضاة الذكاء الاصطناعي أن يتجاوزوا التحيز؟ دراسة شاملة لاستراتيجيات التخفيف من التحيز في نماذج القضاة!
أبحاث

كيف يمكن لقضاة الذكاء الاصطناعي أن يتجاوزوا التحيز؟ دراسة شاملة لاستراتيجيات التخفيف من التحيز في نماذج القضاة!

أركايف للذكاءمنذ 2 شهر
👁 1
ماركت بنش: تقييم وكلاء الذكاء الاصطناعي كمتعاملين في الأسواق
أبحاث

ماركت بنش: تقييم وكلاء الذكاء الاصطناعي كمتعاملين في الأسواق

أركايف للذكاءمنذ 2 شهر
👁 1
تقييم رحلات المدن المستدامة: الذكاء الاصطناعي كقاضي وضرورة التعاون البشري!
أبحاث

تقييم رحلات المدن المستدامة: الذكاء الاصطناعي كقاضي وضرورة التعاون البشري!

أركايف للذكاءمنذ 2 شهر
👁 1
تقييم وكيل البحث في عالم متوازي: كيف نواجه تحديات الذكاء الاصطناعي؟
أبحاث

تقييم وكيل البحث في عالم متوازي: كيف نواجه تحديات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر
👁 1
QEVA: المعيار الثوري لتقييم تلخيص الفيديوهات بلا مراجع
أبحاث

QEVA: المعيار الثوري لتقييم تلخيص الفيديوهات بلا مراجع

أركايف للذكاءمنذ 2 شهر