Ailoxa Logo

🏷️ #التعلم التعزيزي

72 مقال

انطلق نحو المستقبل: التحكم الذكي في التدريب المختلط بفضل GAC!
أبحاث

انطلق نحو المستقبل: التحكم الذكي في التدريب المختلط بفضل GAC!

أركايف للذكاءمنذ 1 شهر
👁 1
من التفكير إلى البرمجة: تحسين GRPO للغات البرمجة الممثلة بشكل ناقص
أبحاث

من التفكير إلى البرمجة: تحسين GRPO للغات البرمجة الممثلة بشكل ناقص

أركايف للذكاءمنذ 1 شهر
👁 1
تحقيق أهداف قائمة على تفضيلات التعلم من السرد السريري لعلاج الإنتان الديناميكي!
أبحاث

تحقيق أهداف قائمة على تفضيلات التعلم من السرد السريري لعلاج الإنتان الديناميكي!

أركايف للذكاءمنذ 1 شهر
اكتشاف ثوري: تحسين الخوارزميات الكمومية باستخدام التعلم التعزيزي!
أبحاث

اكتشاف ثوري: تحسين الخوارزميات الكمومية باستخدام التعلم التعزيزي!

أركايف للذكاءمنذ 1 شهر
ثورة في التعلم التعزيزي: كيفية تحسين نماذج اللغات الضخمة باستخدام تقنية SFT عبر متوسط الـ Logits
أبحاث

ثورة في التعلم التعزيزي: كيفية تحسين نماذج اللغات الضخمة باستخدام تقنية SFT عبر متوسط الـ Logits

أركايف للذكاءمنذ 2 شهر
ثورة جديدة في تحليل التصوير الطبي: نظام مكافآت ذكي لتحسين الدقة السريرية!
أبحاث

ثورة جديدة في تحليل التصوير الطبي: نظام مكافآت ذكي لتحسين الدقة السريرية!

أركايف للذكاءمنذ 2 شهر
هل يمكن للذكاء الاصطناعي تحديد مدة الضربات في ألعاب القتال؟ استراتيجيات جديدة قد تغير مجرى اللعب!
أبحاث

هل يمكن للذكاء الاصطناعي تحديد مدة الضربات في ألعاب القتال؟ استراتيجيات جديدة قد تغير مجرى اللعب!

أركايف للذكاءمنذ 2 شهر
CRAFT: تحوُّل ثوري في سلامة نظم الذكاء الاصطناعي بفضل التعلم من التمثيلات الخفية
أبحاث

CRAFT: تحوُّل ثوري في سلامة نظم الذكاء الاصطناعي بفضل التعلم من التمثيلات الخفية

أركايف للذكاءمنذ 2 شهر
SAPO: تحسين السياسة المتماشية لاقتراحات الذكاء الاصطناعي باستخدام خطوات التفكير!
أبحاث

SAPO: تحسين السياسة المتماشية لاقتراحات الذكاء الاصطناعي باستخدام خطوات التفكير!

أركايف للذكاءمنذ 2 شهر
👁 1
استكشاف إمكانيات نماذج الانتشار في قيادة السيارات الذاتية الكاملة
روبوتات

استكشاف إمكانيات نماذج الانتشار في قيادة السيارات الذاتية الكاملة

أركايف للذكاءمنذ 2 شهر
ثورة جديدة في الذكاء الاصطناعي: التعلم التعزيزي الهيكلي لتحسين نماذج اللغات متعددة الوسائط
أبحاث

ثورة جديدة في الذكاء الاصطناعي: التعلم التعزيزي الهيكلي لتحسين نماذج اللغات متعددة الوسائط

أركايف للذكاءمنذ 2 شهر
ثورة جديدة في الذكاء الاصطناعي: تدريب النماذج اللغوية على تقدير عدم اليقين!
أبحاث

ثورة جديدة في الذكاء الاصطناعي: تدريب النماذج اللغوية على تقدير عدم اليقين!

أركايف للذكاءمنذ 2 شهر
مذهل! CrystalReasoner: ثورة في توليد الهياكل البلورية باستخدام الذكاء الاصطناعي
أبحاث

مذهل! CrystalReasoner: ثورة في توليد الهياكل البلورية باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
احصل على أداء مذهل في التعلم التعزيزي مع استراتيجية Delightful Distributed Policy Gradient
أبحاث

احصل على أداء مذهل في التعلم التعزيزي مع استراتيجية Delightful Distributed Policy Gradient

أركايف للذكاءمنذ 2 شهر
👁 1
تعليم نماذج اللغات الضخمة التفكير من خلال الصور: اكتشاف GRIT المثير!
أبحاث

تعليم نماذج اللغات الضخمة التفكير من خلال الصور: اكتشاف GRIT المثير!

أركايف للذكاءمنذ 2 شهر
تجديد السياسات المشتقة: كيف تعزز مرونة التعزيز من أداء الأنظمة الذكية؟
أبحاث

تجديد السياسات المشتقة: كيف تعزز مرونة التعزيز من أداء الأنظمة الذكية؟

أركايف للذكاءمنذ 2 شهر
تحويل غير خطي: تمكين التعميم عبر المجالات في تعلم التعزيز من خلال نماذج المحولات
أبحاث

تحويل غير خطي: تمكين التعميم عبر المجالات في تعلم التعزيز من خلال نماذج المحولات

أركايف للذكاءمنذ 2 شهر
Q-Probe: ثورة في تقييم جودة الصور العالية الدقة مع استراتيجيات جديدة متطورة!
أبحاث

Q-Probe: ثورة في تقييم جودة الصور العالية الدقة مع استراتيجيات جديدة متطورة!

أركايف للذكاءمنذ 2 شهر
نقطة تحول في التعلم التعزيزي: خوارزميات جديدة مدعومة بمشغل كوبمان
أبحاث

نقطة تحول في التعلم التعزيزي: خوارزميات جديدة مدعومة بمشغل كوبمان

أركايف للذكاءمنذ 2 شهر
ثورة التعلم التعزيزي: كيف تُعيد نماذج اللغات الضخمة تشكيل الذكاء الاصطناعي؟
أبحاث

ثورة التعلم التعزيزي: كيف تُعيد نماذج اللغات الضخمة تشكيل الذكاء الاصطناعي؟

أركايف للذكاءمنذ 2 شهر