Ailoxa Logo

🏷️ #تعلم تعزيز

74 مقال

كيف تسهم الحزم الأكبر في تسريع تعلم نماذج اللغة الكبيرة؟
أبحاث

كيف تسهم الحزم الأكبر في تسريع تعلم نماذج اللغة الكبيرة؟

أركايف للذكاءمنذ 2 يوم
👁 2
نموذج القرار المتكرر التطوري: كيف نفهم السلوكيات التكيفية وغير التكيفية?
أبحاث

نموذج القرار المتكرر التطوري: كيف نفهم السلوكيات التكيفية وغير التكيفية?

أركايف للذكاءمنذ 8 يوم
👁 1
ثورة في الذكاء الاصطناعي: HiDiffTIR يعيد تعريف استراتيجيات التعزيز المعقدة!
أبحاث

ثورة في الذكاء الاصطناعي: HiDiffTIR يعيد تعريف استراتيجيات التعزيز المعقدة!

أركايف للذكاءمنذ 9 يوم
👁 1
كيفية تدريب الناقد بكفاءة وثبات: استراتيجيات مبتكرة في تعلم تعزيز المجموعة
أبحاث

كيفية تدريب الناقد بكفاءة وثبات: استراتيجيات مبتكرة في تعلم تعزيز المجموعة

أركايف للذكاءمنذ 9 يوم
ثورة في إدارة الأحمال الحرارية: تعلم تعزيز التجميع لصنع محاكاة تحكم مغناطيسي مبتكرة!
أبحاث

ثورة في إدارة الأحمال الحرارية: تعلم تعزيز التجميع لصنع محاكاة تحكم مغناطيسي مبتكرة!

أركايف للذكاءمنذ 10 يوم
👁 3
تعلم التعزيز مع نماذج العالم: طريقة QWM تعيد صياغة الفعالية!
أبحاث

تعلم التعزيز مع نماذج العالم: طريقة QWM تعيد صياغة الفعالية!

أركايف للذكاءمنذ 15 يوم
تعلم التعزيز الواعي بالانكماش: ثورة في التحكم غير الخطي مع تعزيز القوة الإحصائية
أبحاث

تعلم التعزيز الواعي بالانكماش: ثورة في التحكم غير الخطي مع تعزيز القوة الإحصائية

أركايف للذكاءمنذ 16 يوم
👁 2
إطار تعلم تعزيز قائم على الرسوم البيانية لعلاج انحرافات الذكاء الاصطناعي في الوكلاء المستقلين
أبحاث

إطار تعلم تعزيز قائم على الرسوم البيانية لعلاج انحرافات الذكاء الاصطناعي في الوكلاء المستقلين

أركايف للذكاءمنذ 17 يوم
👁 1
معركة الإقناع: كيف تكشف نماذج اللغات الضخمة عن ضعفها في مواجهة التأثيرات الخاطئة!
أبحاث

معركة الإقناع: كيف تكشف نماذج اللغات الضخمة عن ضعفها في مواجهة التأثيرات الخاطئة!

أركايف للذكاءمنذ 21 يوم
👁 1
SKILLER: الثورية في تعلم التعزيز لإنشاء المهارات الذكية في نماذج اللغة الصغيرة!
نماذج لغوية

SKILLER: الثورية في تعلم التعزيز لإنشاء المهارات الذكية في نماذج اللغة الصغيرة!

أركايف للذكاءمنذ 22 يوم
مكافآت التوافق: منهج ثوري في تعلم التعزيز أثناء الاختبار
أبحاث

مكافآت التوافق: منهج ثوري في تعلم التعزيز أثناء الاختبار

أركايف للذكاءمنذ 23 يوم
👁 2
تعلم تعزيز متعدد المستويات: خوارزمية ثورية تحل مشكلة التعقيد العيني!
أبحاث

تعلم تعزيز متعدد المستويات: خوارزمية ثورية تحل مشكلة التعقيد العيني!

أركايف للذكاءمنذ 1 شهر
ثورة جديدة في الذكاء الاصطناعي: إطار تعلم التعزيز الذاتي للنماذج متعددة الوسائط!
أبحاث

ثورة جديدة في الذكاء الاصطناعي: إطار تعلم التعزيز الذاتي للنماذج متعددة الوسائط!

أركايف للذكاءمنذ 1 شهر
👁 1
OpenForgeRL: ثورة في تدريب الوكلاء الذكيين في أي بيئة!
أبحاث

OpenForgeRL: ثورة في تدريب الوكلاء الذكيين في أي بيئة!

أركايف للذكاءمنذ 1 شهر
👁 1
تعلم تعزيز الذكاء الاصطناعي: كيفية اختيار الأدلة الدقيقة من نتائج البحث الملوثة
أبحاث

تعلم تعزيز الذكاء الاصطناعي: كيفية اختيار الأدلة الدقيقة من نتائج البحث الملوثة

أركايف للذكاءمنذ 1 شهر
👁 2
نحو تعلم تعزيز متعدد الوكلاء القابل للتكيف: مراجعة مبتكرة تركز على الفرضيات!
أبحاث

نحو تعلم تعزيز متعدد الوكلاء القابل للتكيف: مراجعة مبتكرة تركز على الفرضيات!

أركايف للذكاءمنذ 1 شهر
👁 1
اكتشاف تقنية SLAC: تعلم تعزيزي آمن وفعال للروبوتات الحقيقية من خلال محاكاة غير إشرافية!
روبوتات

اكتشاف تقنية SLAC: تعلم تعزيزي آمن وفعال للروبوتات الحقيقية من خلال محاكاة غير إشرافية!

أركايف للذكاءمنذ 1 شهر
👁 2
استكشاف تعلم التعزيز المدعوم بإشارات الدماغ: ثورة في سلوك الروبوتات!
روبوتات

استكشاف تعلم التعزيز المدعوم بإشارات الدماغ: ثورة في سلوك الروبوتات!

أركايف للذكاءمنذ 1 شهر
👁 2
تعلم التعزيز من غير اتصال إلى اتصال: مستقبل الذكاء الاصطناعي في البيئات الديناميكية
أبحاث

تعلم التعزيز من غير اتصال إلى اتصال: مستقبل الذكاء الاصطناعي في البيئات الديناميكية

أركايف للذكاءمنذ 1 شهر
👁 1
اكتشاف Robo-ValueRL: ثورة جديدة في تقدير القيم في تعلم التعزيز من offline إلى online
أبحاث

اكتشاف Robo-ValueRL: ثورة جديدة في تقدير القيم في تعلم التعزيز من offline إلى online

أركايف للذكاءمنذ 1 شهر
👁 1