Ailoxa Logo

🏷️ #تقييم الأداء

165 مقال

تقييم شامل لنماذج حراسة السلامة المفتوحة المصدر: كيف تختار الأفضل لحماية تطبيقات الذكاء الاصطناعي؟
أبحاث

تقييم شامل لنماذج حراسة السلامة المفتوحة المصدر: كيف تختار الأفضل لحماية تطبيقات الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
فتح آفاق جديدة في البرمجة التنافسية: استراتيجيات متقدمة لتقييم الأداء بدقة وفعالية
أبحاث

فتح آفاق جديدة في البرمجة التنافسية: استراتيجيات متقدمة لتقييم الأداء بدقة وفعالية

أركايف للذكاءمنذ 1 شهر
EgoBench: منصة جديدة ثورية لتقييم وكالات الذكاء الاصطناعي متعددة المهارات!
أبحاث

EgoBench: منصة جديدة ثورية لتقييم وكالات الذكاء الاصطناعي متعددة المهارات!

أركايف للذكاءمنذ 1 شهر
اكتشاف قوة الانتظار: أداة AsyncTool تقيم استجابة وظائف الذكاء الاصطناعي في سيناريوهات متعددة المهام!
أدوات

اكتشاف قوة الانتظار: أداة AsyncTool تقيم استجابة وظائف الذكاء الاصطناعي في سيناريوهات متعددة المهام!

أركايف للذكاءمنذ 1 شهر
هل تعكس المعايير التقليدية أداء نماذج الذكاء الاصطناعي؟ تعرف على RAMP لتقييم فعالية النماذج في أنظمة الإنتاج!
أبحاث

هل تعكس المعايير التقليدية أداء نماذج الذكاء الاصطناعي؟ تعرف على RAMP لتقييم فعالية النماذج في أنظمة الإنتاج!

أركايف للذكاءمنذ 1 شهر
ثورة جديدة في القانون الألماني: تقييم أنظمة الذكاء الاصطناعي في التفكير القانوني!
أبحاث

ثورة جديدة في القانون الألماني: تقييم أنظمة الذكاء الاصطناعي في التفكير القانوني!

أركايف للذكاءمنذ 1 شهر
استكشاف قدرات نماذج اللغة الكبيرة: معيار جديد للذكاء الاصطناعي في معالجة الصور النصية المعقدة
نماذج لغوية

استكشاف قدرات نماذج اللغة الكبيرة: معيار جديد للذكاء الاصطناعي في معالجة الصور النصية المعقدة

أركايف للذكاءمنذ 1 شهر
ثورة الذكاء الاصطناعي: إطار مبتكر لتقييم مساهمات الفرق وحل النزاعات!
أبحاث

ثورة الذكاء الاصطناعي: إطار مبتكر لتقييم مساهمات الفرق وحل النزاعات!

أركايف للذكاءمنذ 1 شهر
اكتشاف وتحجيم انحياز القياس في نماذج اللغة الكبيرة: كيف نحسن الأداء في بيئات الإنتاج؟
أبحاث

اكتشاف وتحجيم انحياز القياس في نماذج اللغة الكبيرة: كيف نحسن الأداء في بيئات الإنتاج؟

أركايف للذكاءمنذ 1 شهر
مهارات تعاقدية: إطار تصميم مبتكر لوكلاء الذكاء الاصطناعي في المؤسسات
أبحاث

مهارات تعاقدية: إطار تصميم مبتكر لوكلاء الذكاء الاصطناعي في المؤسسات

أركايف للذكاءمنذ 1 شهر
AvalancheBench: ثورة في تقييم وكلاء البيانات المؤسسية من خلال استرداد العالم الكامن!
أدوات

AvalancheBench: ثورة في تقييم وكلاء البيانات المؤسسية من خلال استرداد العالم الكامن!

أركايف للذكاءمنذ 1 شهر
فهم خريطة الذكاء الاصطناعي: الكشف عن ديناميكيات تصنيفات الأداء
أبحاث

فهم خريطة الذكاء الاصطناعي: الكشف عن ديناميكيات تصنيفات الأداء

أركايف للذكاءمنذ 1 شهر
تقييم دقيق لمستوى المطالبات في الذكاء الاصطناعي: نقلة نوعية في القانون
أبحاث

تقييم دقيق لمستوى المطالبات في الذكاء الاصطناعي: نقلة نوعية في القانون

أركايف للذكاءمنذ 2 شهر
اكتشاف ثورة البرمجة: كيف يغير InteractScience جيل الأكواد العلمية التفاعلية؟
أبحاث

اكتشاف ثورة البرمجة: كيف يغير InteractScience جيل الأكواد العلمية التفاعلية؟

أركايف للذكاءمنذ 2 شهر
AgentAtlas: ثورة معايير تقييم وكالات نماذج اللغة الكبيرة
أبحاث

AgentAtlas: ثورة معايير تقييم وكالات نماذج اللغة الكبيرة

أركايف للذكاءمنذ 2 شهر
WARC-Bench: ثورة في تقييم أداء وكالات الذكاء الاصطناعي على الويب!
أبحاث

WARC-Bench: ثورة في تقييم أداء وكالات الذكاء الاصطناعي على الويب!

أركايف للذكاءمنذ 2 شهر
أحدث تقنيات التوجيه للذكاء الاصطناعي: تعرف على TwinRouterBench!
أبحاث

أحدث تقنيات التوجيه للذكاء الاصطناعي: تعرف على TwinRouterBench!

أركايف للذكاءمنذ 2 شهر
PRISM: معيار ثوري لتقييم المنطق الزمني المكاني في توليد الفيديو البرمجي
أبحاث

PRISM: معيار ثوري لتقييم المنطق الزمني المكاني في توليد الفيديو البرمجي

أركايف للذكاءمنذ 2 شهر
استراتيجيات تقطيع القانون الألماني: كيف تعزز الفهم والبحث القانوني؟
أبحاث

استراتيجيات تقطيع القانون الألماني: كيف تعزز الفهم والبحث القانوني؟

أركايف للذكاءمنذ 2 شهر
👁 1
تقييم وكالات البحث العميقة: ثورة في استشارات الخبراء!
أبحاث

تقييم وكالات البحث العميقة: ثورة في استشارات الخبراء!

أركايف للذكاءمنذ 2 شهر