🏷️ #تعلم معزز
555 مقال
أبحاث
ثورة في التحكم بالشبكات الكهربائية: التعلم المعزز الهيراركي مع درع السلامة في الوقت الحقيقي!
أركايف للذكاءمنذ 4 شهر
👁 2أبحاث
ثورة في التعلم المعزز: ما الجديد في إطار STEP-HRL للذكاء الاصطناعي؟
أركايف للذكاءمنذ 4 شهر
أبحاث
ثورة التعلم الذاتي: نموذج ECHO الذي يغير قواعد اللعبة في الذكاء الاصطناعي
أركايف للذكاءمنذ 4 شهر
👁 2أبحاث
قفزة مذهلة في الذكاء الاصطناعي: إطار KnowRL لتعزيز التفكير في نماذج اللغات الكبيرة!
أركايف للذكاءمنذ 4 شهر
أبحاث
ثورة في تدريب وكلاء البحث: تقنية Cycle-Consistent Search تقدم بديلاً مبتكرًا!
أركايف للذكاءمنذ 4 شهر
أبحاث
ثورة في المراقبة البحرية: التعلم العميق متعدد المهام لمراقبة الشعاب المرجانية بشكل مستقل
أركايف للذكاءمنذ 4 شهر
نماذج لغوية
قفزة مذهلة: هل تُوسِّع RLVR حدود التفكير في نماذج الرؤية-اللغة؟
أركايف للذكاءمنذ 4 شهر
أبحاث
كل ما تحتاج لمعرفته حول التنفيذ الثوري لـ RLHF باستخدام PPO!
هاجينج فيسمنذ 34 شهر
👁 1أبحاث
استكشف Q-Learning: المفتاح لفهم التعلم المعزز!
هاجينج فيسمنذ 52 شهر
أبحاث
سلامة الذكاء الاصطناعي: إطلاق "Safety Gym" لتدريب الوكلاء بشكل آمن!
مدونة أوبن إيه آيمنذ 82 شهر
أبحاث
اكتشاف الخيارات المتغيرة: كيف تفتح خوارزميات جديدة آفاقاً غير مسبوقة في الذكاء الاصطناعي!
مدونة أوبن إيه آيمنذ 98 شهر
أبحاث
تعلم بسرعة: معيار جديد في التعميم في التعلم المعزز!
مدونة أوبن إيه آيمنذ 102 شهر
أبحاث
استكشاف أفضل مع ضوضاء معلمات التعلم المعزز!
مدونة أوبن إيه آيمنذ 110 شهر
أبحاث
اكتشف أسرار التعلم المعزز: OpenAI تطلق DQN مع أنماط جديدة!
مدونة أوبن إيه آيمنذ 113 شهر
أبحاث
استكشاف جديد في التعلم العميق: كيف يعيد العد تشكيل خوارزميات التعزيز!
مدونة أوبن إيه آيمنذ 119 شهر
👁 1← السابق28 / 28
