Ailoxa Logo

🏷️ #تعلم معزز

438 مقال

ثورة جديد في التعلم المعزز: تقنية Soft Q(λ) تفتح آفاقاً جديدة في الذكاء الاصطناعي!
أبحاث

ثورة جديد في التعلم المعزز: تقنية Soft Q(λ) تفتح آفاقاً جديدة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 3 شهر
ثورة في التعلم المعزز: ما الجديد في إطار STEP-HRL للذكاء الاصطناعي؟
أبحاث

ثورة في التعلم المعزز: ما الجديد في إطار STEP-HRL للذكاء الاصطناعي؟

أركايف للذكاءمنذ 3 شهر
WOMBET: ثورة في نقل الخبرات لتعزيز التعلم المعزز بكفاءة عالية
أبحاث

WOMBET: ثورة في نقل الخبرات لتعزيز التعلم المعزز بكفاءة عالية

أركايف للذكاءمنذ 3 شهر
👁 1
ثورة في التحكم بالشبكات الكهربائية: التعلم المعزز الهيراركي مع درع السلامة في الوقت الحقيقي!
أبحاث

ثورة في التحكم بالشبكات الكهربائية: التعلم المعزز الهيراركي مع درع السلامة في الوقت الحقيقي!

أركايف للذكاءمنذ 3 شهر
القيود الذهبية: كيف تجعل وكلاء الذكاء الاصطناعي أكثر أماناً؟
أبحاث

القيود الذهبية: كيف تجعل وكلاء الذكاء الاصطناعي أكثر أماناً؟

أركايف للذكاءمنذ 3 شهر
ثورة في تدريب وكلاء البحث: تقنية Cycle-Consistent Search تقدم بديلاً مبتكرًا!
أبحاث

ثورة في تدريب وكلاء البحث: تقنية Cycle-Consistent Search تقدم بديلاً مبتكرًا!

أركايف للذكاءمنذ 3 شهر
قفزة مذهلة في الذكاء الاصطناعي: إطار KnowRL لتعزيز التفكير في نماذج اللغات الكبيرة!
أبحاث

قفزة مذهلة في الذكاء الاصطناعي: إطار KnowRL لتعزيز التفكير في نماذج اللغات الكبيرة!

أركايف للذكاءمنذ 3 شهر
ثورة التعلم الذاتي: نموذج ECHO الذي يغير قواعد اللعبة في الذكاء الاصطناعي
أبحاث

ثورة التعلم الذاتي: نموذج ECHO الذي يغير قواعد اللعبة في الذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر
قفزة مذهلة: هل تُوسِّع RLVR حدود التفكير في نماذج الرؤية-اللغة؟
نماذج لغوية

قفزة مذهلة: هل تُوسِّع RLVR حدود التفكير في نماذج الرؤية-اللغة؟

أركايف للذكاءمنذ 3 شهر
ثورة في المراقبة البحرية: التعلم العميق متعدد المهام لمراقبة الشعاب المرجانية بشكل مستقل
أبحاث

ثورة في المراقبة البحرية: التعلم العميق متعدد المهام لمراقبة الشعاب المرجانية بشكل مستقل

أركايف للذكاءمنذ 3 شهر
كل ما تحتاج لمعرفته حول التنفيذ الثوري لـ RLHF باستخدام PPO!
أبحاث

كل ما تحتاج لمعرفته حول التنفيذ الثوري لـ RLHF باستخدام PPO!

هاجينج فيسمنذ 33 شهر
👁 1
استكشف Q-Learning: المفتاح لفهم التعلم المعزز!
أبحاث

استكشف Q-Learning: المفتاح لفهم التعلم المعزز!

هاجينج فيسمنذ 50 شهر
سلامة الذكاء الاصطناعي: إطلاق "Safety Gym" لتدريب الوكلاء بشكل آمن!
أبحاث

سلامة الذكاء الاصطناعي: إطلاق "Safety Gym" لتدريب الوكلاء بشكل آمن!

مدونة أوبن إيه آيمنذ 81 شهر
اكتشاف الخيارات المتغيرة: كيف تفتح خوارزميات جديدة آفاقاً غير مسبوقة في الذكاء الاصطناعي!
أبحاث

اكتشاف الخيارات المتغيرة: كيف تفتح خوارزميات جديدة آفاقاً غير مسبوقة في الذكاء الاصطناعي!

مدونة أوبن إيه آيمنذ 97 شهر
تعلم بسرعة: معيار جديد في التعميم في التعلم المعزز!
أبحاث

تعلم بسرعة: معيار جديد في التعميم في التعلم المعزز!

مدونة أوبن إيه آيمنذ 100 شهر
استكشاف أفضل مع ضوضاء معلمات التعلم المعزز!
أبحاث

استكشاف أفضل مع ضوضاء معلمات التعلم المعزز!

مدونة أوبن إيه آيمنذ 109 شهر
اكتشف أسرار التعلم المعزز: OpenAI تطلق DQN مع أنماط جديدة!
أبحاث

اكتشف أسرار التعلم المعزز: OpenAI تطلق DQN مع أنماط جديدة!

مدونة أوبن إيه آيمنذ 111 شهر
استكشاف جديد في التعلم العميق: كيف يعيد العد تشكيل خوارزميات التعزيز!
أبحاث

استكشاف جديد في التعلم العميق: كيف يعيد العد تشكيل خوارزميات التعزيز!

مدونة أوبن إيه آيمنذ 117 شهر