Ailoxa Logo

🏷️ #تقييم الأداء

162 مقال

ثورة جديدة في الذكاء الاصطناعي: Introducing DrawingVQA لتقييم القدرات الرسومية والنصية!
أبحاث

ثورة جديدة في الذكاء الاصطناعي: Introducing DrawingVQA لتقييم القدرات الرسومية والنصية!

أركايف للذكاءمنذ 12 ساعة
👁 1
هل يمكن للذكاء الاصطناعي مواجهة الضغوط المتكررة؟ اكتشافات جديدة حول نماذج الرؤية واللغة!
أبحاث

هل يمكن للذكاء الاصطناعي مواجهة الضغوط المتكررة؟ اكتشافات جديدة حول نماذج الرؤية واللغة!

أركايف للذكاءمنذ 3 يوم
👁 1
ثورة في تقييم أداء الوكلاء الذكيين: تعرف على MCPEvol-Bench
أبحاث

ثورة في تقييم أداء الوكلاء الذكيين: تعرف على MCPEvol-Bench

أركايف للذكاءمنذ 3 يوم
👁 1
تقييم أمني مبتكر: كيف يؤثر التكلفة على أداء وكيل الأمن الهجومي والدفاعي؟
أبحاث

تقييم أمني مبتكر: كيف يؤثر التكلفة على أداء وكيل الأمن الهجومي والدفاعي؟

أركايف للذكاءمنذ 3 يوم
مفارقة البساطة: تفكيك الأسطورة حول استراتيجيات التوجيه وتقييم نماذج اللغة الكبيرة
أبحاث

مفارقة البساطة: تفكيك الأسطورة حول استراتيجيات التوجيه وتقييم نماذج اللغة الكبيرة

أركايف للذكاءمنذ 3 يوم
👁 1
نقلة نوعية في نماذج تحويل النص إلى صوت: تحسين دقة التنفيذ عبر ملاحظات دقيقة
نماذج لغوية

نقلة نوعية في نماذج تحويل النص إلى صوت: تحسين دقة التنفيذ عبر ملاحظات دقيقة

أركايف للذكاءمنذ 4 يوم
👁 1
STOCKTAKE: القياس بين الإدراك والعمل في نماذج اللغات الضخمة
أبحاث

STOCKTAKE: القياس بين الإدراك والعمل في نماذج اللغات الضخمة

أركايف للذكاءمنذ 4 يوم
👁 1
إعادة التفكير في تقييم تطوير الهياكل التلقائية لوكلاء الذكاء الاصطناعي!
أبحاث

إعادة التفكير في تقييم تطوير الهياكل التلقائية لوكلاء الذكاء الاصطناعي!

أركايف للذكاءمنذ 5 يوم
👁 1
اكتشاف ثورة جديدة في تصميم ألعاب الإيقاع: تقنية ChartGenEval تقدم معايير مبتكرة!
أبحاث

اكتشاف ثورة جديدة في تصميم ألعاب الإيقاع: تقنية ChartGenEval تقدم معايير مبتكرة!

أركايف للذكاءمنذ 5 يوم
ثورة في عالم الكروشيه: هل تستطيع نماذج الرؤية - اللغة الانتقال من الوصف إلى التنفيذ؟
أبحاث

ثورة في عالم الكروشيه: هل تستطيع نماذج الرؤية - اللغة الانتقال من الوصف إلى التنفيذ؟

أركايف للذكاءمنذ 5 يوم
BizFinBench.v2: النظام المبتكر لتقييم الأداء الموثوق لنماذج اللغات الضخمة في القطاع المالي!
أبحاث

BizFinBench.v2: النظام المبتكر لتقييم الأداء الموثوق لنماذج اللغات الضخمة في القطاع المالي!

أركايف للذكاءمنذ 6 يوم
اكتشف MM-ToolSandBox: الإطار الثوري لتقييم وكلاء أدوات الاتصال المرئي!
أدوات

اكتشف MM-ToolSandBox: الإطار الثوري لتقييم وكلاء أدوات الاتصال المرئي!

أركايف للذكاءمنذ 6 يوم
👁 1
البصمة الخفية: كيف يمكن لتخزين البيانات أن يصبح مقياسًا أساسيًا لتقييم وكيل نماذج اللغات الضخمة!
أبحاث

البصمة الخفية: كيف يمكن لتخزين البيانات أن يصبح مقياسًا أساسيًا لتقييم وكيل نماذج اللغات الضخمة!

أركايف للذكاءمنذ 6 يوم
إعادة تشكيل الذكاء الاصطناعي: أداة جديدة لتقييم قدرات النماذج اللغوية في هندسة البرمجيات العكسية!
أبحاث

إعادة تشكيل الذكاء الاصطناعي: أداة جديدة لتقييم قدرات النماذج اللغوية في هندسة البرمجيات العكسية!

أركايف للذكاءمنذ 7 يوم
👁 1
تحدي AUTOPILOT VQA: قياس كفاءة نماذج الرؤية واللغة في فهم فيديوهات الكاميرات الميجانية
أبحاث

تحدي AUTOPILOT VQA: قياس كفاءة نماذج الرؤية واللغة في فهم فيديوهات الكاميرات الميجانية

أركايف للذكاءمنذ 10 يوم
👁 2
استكشاف بيئات الذكاء الاصطناعي: تصميم تجريبي لتقييم نماذج الاكتشاف الذاتي
أبحاث

استكشاف بيئات الذكاء الاصطناعي: تصميم تجريبي لتقييم نماذج الاكتشاف الذاتي

أركايف للذكاءمنذ 12 يوم
👁 1
شركات تتاجر بالموظفين مقابل توكنات! هل تحقق العائدات المرجوة؟
شركات

شركات تتاجر بالموظفين مقابل توكنات! هل تحقق العائدات المرجوة؟

أخبار الذكاء اليوميةمنذ 13 يوم
👁 1
إطار جبري موحد لتقييم أداء التصنيف: تطور جديد في عالم الذكاء الاصطناعي!
أبحاث

إطار جبري موحد لتقييم أداء التصنيف: تطور جديد في عالم الذكاء الاصطناعي!

أركايف للذكاءمنذ 13 يوم
👁 1
كيف تعيد معايير البرمجة تشكيل مستقبل النماذج اللغوية؟
أبحاث

كيف تعيد معايير البرمجة تشكيل مستقبل النماذج اللغوية؟

أركايف للذكاءمنذ 13 يوم
👁 2
كيف يمكن لتقنيات الذكاء الاصطناعي تحسين تقويم أداء التمارين الرياضية؟
أبحاث

كيف يمكن لتقنيات الذكاء الاصطناعي تحسين تقويم أداء التمارين الرياضية؟

أركايف للذكاءمنذ 13 يوم
👁 1