Ailoxa Logo

🏷️ #معايير الأداء

17 مقال

اكتشاف قوة الذاكرة الطويلة في وكالات نماذج اللغة: تقييم تكاليف الأداء
أبحاث

اكتشاف قوة الذاكرة الطويلة في وكالات نماذج اللغة: تقييم تكاليف الأداء

أركايف للذكاءمنذ 3 يوم
تكنولوجيا رائدة: SingProbe تعيد تعريف حراسة وقت التشغيل لنماذج اللغات الضخمة!
أبحاث

تكنولوجيا رائدة: SingProbe تعيد تعريف حراسة وقت التشغيل لنماذج اللغات الضخمة!

أركايف للذكاءمنذ 12 يوم
👁 1
نتكونفا أريناس: معيار تنفيذي مبتكر لقياس وكالات نماذج اللغة الكبيرة في تكوين الشبكات المغلقة
أبحاث

نتكونفا أريناس: معيار تنفيذي مبتكر لقياس وكالات نماذج اللغة الكبيرة في تكوين الشبكات المغلقة

أركايف للذكاءمنذ 19 يوم
👁 1
تحقيق أداء مذهل في تمييز الصوت: كيف نقيس تحسين المعايير؟
أبحاث

تحقيق أداء مذهل في تمييز الصوت: كيف نقيس تحسين المعايير؟

هاجينج فيسمنذ 23 يوم
👁 2
التقييم الآلي لوكلاء اللغة الذكية: هل يمكن الاعتماد على نتائجها؟
أبحاث

التقييم الآلي لوكلاء اللغة الذكية: هل يمكن الاعتماد على نتائجها؟

أركايف للذكاءمنذ 1 شهر
👁 1
إنفراس بنش: معيار جديد لتحسين استنتاجات نماذج اللغات الضخمة بواسطة وكلاء الذكاء الاصطناعي!
أبحاث

إنفراس بنش: معيار جديد لتحسين استنتاجات نماذج اللغات الضخمة بواسطة وكلاء الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
👁 1
مفاجأة في عالم الذكاء الاصطناعي: إطلاق SciCodePile، أكبر قاعدة بيانات للبرمجة العلمية!
أبحاث

مفاجأة في عالم الذكاء الاصطناعي: إطلاق SciCodePile، أكبر قاعدة بيانات للبرمجة العلمية!

أركايف للذكاءمنذ 1 شهر
👁 1
كشف الستار عن الاختلالات في تحليلات الجذور: تدقيق بروتوكول النتائج في معايير الأداء
أبحاث

كشف الستار عن الاختلالات في تحليلات الجذور: تدقيق بروتوكول النتائج في معايير الأداء

أركايف للذكاءمنذ 2 شهر
👁 3
Riemann-Bench: معيار جديد للذكاء الاصطناعي في الرياضيات المتقدمة
أبحاث

Riemann-Bench: معيار جديد للذكاء الاصطناعي في الرياضيات المتقدمة

أركايف للذكاءمنذ 2 شهر
👁 1
داكس: نموذج ثوري لتعلم تمثيلات علم الأمراض العامة عبر المقاييس
أبحاث

داكس: نموذج ثوري لتعلم تمثيلات علم الأمراض العامة عبر المقاييس

أركايف للذكاءمنذ 3 شهر
معايير الذكاء الاصطناعي في سلامة القيادة الذاتية: كيف يمكن تحسينها؟
أبحاث

معايير الذكاء الاصطناعي في سلامة القيادة الذاتية: كيف يمكن تحسينها؟

أركايف للذكاءمنذ 3 شهر
تحديات قياس كفاءة الامتناع في الوكلاء المستقلين: لماذا تحتاج المعايير إلى تحديث؟
أبحاث

تحديات قياس كفاءة الامتناع في الوكلاء المستقلين: لماذا تحتاج المعايير إلى تحديث؟

أركايف للذكاءمنذ 3 شهر
👁 2
AgentKernelArena: معيار مبتكر لقياس كفاءة وكيل تحسين نوى GPU في عصر الذكاء الاصطناعي
أبحاث

AgentKernelArena: معيار مبتكر لقياس كفاءة وكيل تحسين نوى GPU في عصر الذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر
استكشف معايير جديدة في توليد الفيديو: EntityBench ودورها في أحداث مرئية متسقة!
أبحاث

استكشف معايير جديدة في توليد الفيديو: EntityBench ودورها في أحداث مرئية متسقة!

أركايف للذكاءمنذ 4 شهر
هل يمكن لمعايير الأداء للوكالات دعم نتائجها؟ اكتشف كيف يمكن لتحليل الأدلة تغيّر المفاهيم!
أبحاث

هل يمكن لمعايير الأداء للوكالات دعم نتائجها؟ اكتشف كيف يمكن لتحليل الأدلة تغيّر المفاهيم!

أركايف للذكاءمنذ 4 شهر
ثورة جديدة في الذكاء الاصطناعي: SREGym منصة معايير حقيقية لوكلاء SRE
أبحاث

ثورة جديدة في الذكاء الاصطناعي: SREGym منصة معايير حقيقية لوكلاء SRE

أركايف للذكاءمنذ 4 شهر
👁 1
EmoTrans: معيار جديد لفهم وتحليل التحولات العاطفية في نماذج اللغة متعددة الأبعاد
أبحاث

EmoTrans: معيار جديد لفهم وتحليل التحولات العاطفية في نماذج اللغة متعددة الأبعاد

أركايف للذكاءمنذ 4 شهر
👁 1