Ailoxa Logo

🏷️ #تعلم تعزيز

57 مقال

استكشاف تعلم التعزيز المدعوم بإشارات الدماغ: ثورة في سلوك الروبوتات!
روبوتات

استكشاف تعلم التعزيز المدعوم بإشارات الدماغ: ثورة في سلوك الروبوتات!

أركايف للذكاءمنذ 3 يوم
👁 1
تعلم التعزيز من غير اتصال إلى اتصال: مستقبل الذكاء الاصطناعي في البيئات الديناميكية
أبحاث

تعلم التعزيز من غير اتصال إلى اتصال: مستقبل الذكاء الاصطناعي في البيئات الديناميكية

أركايف للذكاءمنذ 6 يوم
👁 1
اكتشاف Robo-ValueRL: ثورة جديدة في تقدير القيم في تعلم التعزيز من offline إلى online
أبحاث

اكتشاف Robo-ValueRL: ثورة جديدة في تقدير القيم في تعلم التعزيز من offline إلى online

أركايف للذكاءمنذ 6 يوم
👁 1
استكشاف مدفوع بالمحفزات: ثورة في تعلم الآلة والتحكم الذكي!
أبحاث

استكشاف مدفوع بالمحفزات: ثورة في تعلم الآلة والتحكم الذكي!

أركايف للذكاءمنذ 7 يوم
👁 1
التخطيط السريع لمسارات الحركة: ثورة في تعلم التعزيز غير المتصل!
أبحاث

التخطيط السريع لمسارات الحركة: ثورة في تعلم التعزيز غير المتصل!

أركايف للذكاءمنذ 7 يوم
👁 1
ابتكار ذكي: تعلم تعزيز متعدد الوكلاء لتطوير مراكز البيانات الذكية والموفرة للطاقة
أبحاث

ابتكار ذكي: تعلم تعزيز متعدد الوكلاء لتطوير مراكز البيانات الذكية والموفرة للطاقة

أركايف للذكاءمنذ 13 يوم
تطوير إطار تعلم تعزيز موجه: كيف يغير TaoSR-AGRL تجربة التسوق الإلكترونية!
أبحاث

تطوير إطار تعلم تعزيز موجه: كيف يغير TaoSR-AGRL تجربة التسوق الإلكترونية!

أركايف للذكاءمنذ 13 يوم
تعزيز جدولة التصنيع الذكي: نموذج جديد لتعلم التعزيز يحل تحديات توقيت توصيل المنتجات المتعددة
أبحاث

تعزيز جدولة التصنيع الذكي: نموذج جديد لتعلم التعزيز يحل تحديات توقيت توصيل المنتجات المتعددة

أركايف للذكاءمنذ 13 يوم
👁 1
ما هو نموذج Maven؟ ثورة في مكافآت السياقات الطويلة في الذكاء الاصطناعي!
أبحاث

ما هو نموذج Maven؟ ثورة في مكافآت السياقات الطويلة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 17 يوم
👁 1
ابتكار ثوري في نماذج الانتشار: التحكم بالوقت والتعلم من خلال سياسة الممثل-الناقد
أبحاث

ابتكار ثوري في نماذج الانتشار: التحكم بالوقت والتعلم من خلال سياسة الممثل-الناقد

أركايف للذكاءمنذ 17 يوم
KAGE-Bench: ثورة في تقييم التعميم البصري للذكاء الاصطناعي في بيئات التعلم المعزز!
أبحاث

KAGE-Bench: ثورة في تقييم التعميم البصري للذكاء الاصطناعي في بيئات التعلم المعزز!

أركايف للذكاءمنذ 18 يوم
ابتكارات مذهلة في شحن المركبات الكهربائية: تعلم تعزيز متعدد الوكلاء لتحقيق الكفاءة!
أبحاث

ابتكارات مذهلة في شحن المركبات الكهربائية: تعلم تعزيز متعدد الوكلاء لتحقيق الكفاءة!

أركايف للذكاءمنذ 19 يوم
تحسين استراتيجيات التعلم التعزيزي لنماذج اللغات الضخمة: انطلاقة جديدة عن طريق تقنية Trust Region Masking!
نماذج لغوية

تحسين استراتيجيات التعلم التعزيزي لنماذج اللغات الضخمة: انطلاقة جديدة عن طريق تقنية Trust Region Masking!

أركايف للذكاءمنذ 21 يوم
تطوير نموذج ATOD: ثورة في تدريب الوكلاء الذكيين لتحقيق أداء متفوق!
أبحاث

تطوير نموذج ATOD: ثورة في تدريب الوكلاء الذكيين لتحقيق أداء متفوق!

أركايف للذكاءمنذ 21 يوم
👁 1
ثورة في الروبوتات: إطار تعلم تعزيز نمائي لتوجيه فعال في أنظمة الالتزام المتنقلة
روبوتات

ثورة في الروبوتات: إطار تعلم تعزيز نمائي لتوجيه فعال في أنظمة الالتزام المتنقلة

أركايف للذكاءمنذ 1 شهر
StarOR: ثورة في نمذجة التحسين عبر دمج البحث الشجري وتعلم التعزيز في وقت الاختبار!
أبحاث

StarOR: ثورة في نمذجة التحسين عبر دمج البحث الشجري وتعلم التعزيز في وقت الاختبار!

أركايف للذكاءمنذ 1 شهر
👁 1
ستubborn: إطار عمل متكامل لتعزيز تعلم الذكاء الاصطناعي في تتبع الحركات وعمليات التعافي من السقوط للروبوتات البشرية
أبحاث

ستubborn: إطار عمل متكامل لتعزيز تعلم الذكاء الاصطناعي في تتبع الحركات وعمليات التعافي من السقوط للروبوتات البشرية

أركايف للذكاءمنذ 1 شهر
اكتشاف قوة AliyunConsoleAgent: أداة رائدة للتحقق من وثائق السحابة باستخدام الذكاء الاصطناعي!
أدوات

اكتشاف قوة AliyunConsoleAgent: أداة رائدة للتحقق من وثائق السحابة باستخدام الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
تعلم التعزيز في الوقت المناسب: كيف يعيد الذكاء الاصطناعي التكيف بدون تحديثات تدرجية!
أبحاث

تعلم التعزيز في الوقت المناسب: كيف يعيد الذكاء الاصطناعي التكيف بدون تحديثات تدرجية!

أركايف للذكاءمنذ 1 شهر
ثورة الذكاء الاصطناعي: تعلم تعزيز ذاتي للرحلات الجوية غير المأهولة
أبحاث

ثورة الذكاء الاصطناعي: تعلم تعزيز ذاتي للرحلات الجوية غير المأهولة

أركايف للذكاءمنذ 1 شهر
👁 1