🏷️ #LLMs
173 مقال
أبحاث
ثورة في نمذجة التحسين: EvoOptiGraph وحل تحديات الذكاء الاصطناعي
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
ثورة جديدة في التداول: اكتشف كيف تغير AlgoEvolve قواعد اللعبة باستخدام الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
في عالم البرمجة: تحطيم الحواجز بإطار العمل VeriPilot لتحسين تصحيح الأخطاء في Verilog!
أركايف للذكاءمنذ 2 شهر
👁 2أبحاث
BIM-Edit: اختبارات جديدة لتقييم نماذج اللغات في هندسة المباني المتطورة!
أركايف للذكاءمنذ 2 شهر
👁 2أبحاث
تحدي RetailBench: قياس قدرة نماذج اللغة الكبيرة على اتخاذ قرارات نمائية في بيئات البيع بالتجزئة
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشف قوة PrologMCP: واجهة أدوات موحدة للذكاء الاصطناعي لتحسين الاستدلال!
أركايف للذكاءمنذ 2 شهر
أبحاث
كيف تحسن نماذج LLMs التنبؤات في بيانات الجدول الصناعي؟
أركايف للذكاءمنذ 2 شهر
أدوات
UXBench: رصد فعالية تقييمات تجربة المستخدم المولدة بواسطة نماذج الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
👁 2أبحاث
Prism: ثورة جديدة في كفاءة استغلال موارد تحليلات الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
أبحاث
مقياس MobilityBench: معيار جديد لتقييم وكلاء تخطيط الطرق في سيناريوهات التنقل الواقعية
أركايف للذكاءمنذ 2 شهر
أبحاث
جديد الذكاء الاصطناعي: أداة JailbreakOPT لتحسين الهجمات المعقدة على نماذج اللغة
أركايف للذكاءمنذ 2 شهر
أبحاث
هل تستطيع نماذج اللغة المتعددة التعرف على أقرانها؟ دراسة مثيرة حول تحليل البيانات السياسية!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
استراتيجيات جديدة للذكاء الاصطناعي: كيف تُحدث HIPIF ثورة في تعلم الوكلاء من خلال التخطيط الهرمي؟
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تقنية مبتكرة: توافق التمثيلات بين الشبكات العصبية ورسوم النص المعتمدة على الطاقة!
أركايف للذكاءمنذ 2 شهر
أبحاث
ثورة جديدة في إثبات النظريات: TheoremBench يقيم نماذج الذكاء الاصطناعي في الرياضيات الرسمية!
أركايف للذكاءمنذ 2 شهر
👁 1نماذج لغوية
ثورة في تدريب نماذج الذكاء الاصطناعي: اكتشف POET-X الفعال والمبتكر!
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشاف انحراف التضمين بدون عينة: حصن خفيف ضد هجمات الحقن في نماذج اللغات الضخمة!
أركايف للذكاءمنذ 2 شهر
👁 1نماذج لغوية
تجاوز الاعتماد على المحفزات في تقييم نماذج الذكاء الاصطناعي: نموذج بايزي مبتكر يغير اللعبة!
أركايف للذكاءمنذ 3 شهر
أبحاث
نظام Benchmark Agent: ثورة في بناء المقاييس لتقييم الذكاء الاصطناعي!
أركايف للذكاءمنذ 3 شهر
👁 1أبحاث
OckBench: قياس كفاءة التفكير في نماذج اللغات الضخمة (LLMs)
أركايف للذكاءمنذ 3 شهر
👁 1