Ailoxa Logo

🏷️ #تعلم التعزيز

117 مقال

OpenAI تكشف النقاب عن نموذج GPT-Red: تفوق ساحق على الفرق البشرية في اختبار الهجمات!
أبحاث

OpenAI تكشف النقاب عن نموذج GPT-Red: تفوق ساحق على الفرق البشرية في اختبار الهجمات!

مارك تيك بوستمنذ 3 يوم
تعلم التعزيز السياقي تحت الظروف غير الثابتة: دراسة شاملة تفتح آفاق جديدة
أبحاث

تعلم التعزيز السياقي تحت الظروف غير الثابتة: دراسة شاملة تفتح آفاق جديدة

أركايف للذكاءمنذ 5 يوم
👁 1
اكتشاف الأسرار وراء سلوكيات الجماعات المعقدة من خلال مكافآت بسيطة
روبوتات

اكتشاف الأسرار وراء سلوكيات الجماعات المعقدة من خلال مكافآت بسيطة

أركايف للذكاءمنذ 5 يوم
من النقد إلى الثقة: انطلاقة CARE-PPO في تقدير الثقة للتنبؤات الكمية المعتمدة على اللغة
أبحاث

من النقد إلى الثقة: انطلاقة CARE-PPO في تقدير الثقة للتنبؤات الكمية المعتمدة على اللغة

أركايف للذكاءمنذ 5 يوم
ثورة الذكاء الاصطناعي في جدولة العمل: تعلم التعزيز المتكيف للتعامل مع الفجوات الزمنية
أبحاث

ثورة الذكاء الاصطناعي في جدولة العمل: تعلم التعزيز المتكيف للتعامل مع الفجوات الزمنية

أركايف للذكاءمنذ 6 يوم
👁 1
VINE: ثورة في التحكم التوليدي للذكاء الاصطناعي في تعلم التعزيز!
أبحاث

VINE: ثورة في التحكم التوليدي للذكاء الاصطناعي في تعلم التعزيز!

أركايف للذكاءمنذ 6 يوم
خطوات ثورية في تعلم التعزيز: تقنيات Q-Learning و Actor-Critic لسياسات أكثر Robustness!
أبحاث

خطوات ثورية في تعلم التعزيز: تقنيات Q-Learning و Actor-Critic لسياسات أكثر Robustness!

أركايف للذكاءمنذ 6 يوم
👁 1
SETA: ثورة في تدريب وكلاء الذكاء الاصطناعي عبر بيئات قابلة للتحقق!
أبحاث

SETA: ثورة في تدريب وكلاء الذكاء الاصطناعي عبر بيئات قابلة للتحقق!

أركايف للذكاءمنذ 6 يوم
إعادة تعريف تعلم التعزيز متعدد الأهداف: اكتشاف استراتيجيات جديدة مع تقنيات D^3PO المتقدمة
أبحاث

إعادة تعريف تعلم التعزيز متعدد الأهداف: اكتشاف استراتيجيات جديدة مع تقنيات D^3PO المتقدمة

أركايف للذكاءمنذ 7 يوم
👁 1
تحسين أداء الشبكات باستخدام تعلم التعزيز: الاستجابة الذكية للتغيرات الديناميكية
أبحاث

تحسين أداء الشبكات باستخدام تعلم التعزيز: الاستجابة الذكية للتغيرات الديناميكية

أركايف للذكاءمنذ 10 يوم
👁 1
ثورة الذكاء الاصطناعي: تحسين كفاءة تعلم نماذج التفاعل البشري باستخدام استراتيجيات مبتكرة!
أبحاث

ثورة الذكاء الاصطناعي: تحسين كفاءة تعلم نماذج التفاعل البشري باستخدام استراتيجيات مبتكرة!

أركايف للذكاءمنذ 11 يوم
قفزة نحو التكيف الفعال وتعزيز القوة في التعلم غير المشرف
أبحاث

قفزة نحو التكيف الفعال وتعزيز القوة في التعلم غير المشرف

أركايف للذكاءمنذ 13 يوم
👁 1
تعلم التعزيز القابل للتفسير: ثورة في إدارة إشارات المرور الذكية
أبحاث

تعلم التعزيز القابل للتفسير: ثورة في إدارة إشارات المرور الذكية

أركايف للذكاءمنذ 13 يوم
👁 1
تحسين فعالية تعلم الآلة: استخدام التقنيات المعتمدة على التنبؤ القائم على الأقنعة
أبحاث

تحسين فعالية تعلم الآلة: استخدام التقنيات المعتمدة على التنبؤ القائم على الأقنعة

أركايف للذكاءمنذ 13 يوم
👁 1
ARLArena: إطار موحد لتعلم التعزيز الوكفي المستقر
أبحاث

ARLArena: إطار موحد لتعلم التعزيز الوكفي المستقر

أركايف للذكاءمنذ 13 يوم
👁 1
إطلاق DRL-CLBA: هجوم خلفي نظيف يهدد تصنيف الصوت باستخدام تعلم التعزيز
أبحاث

إطلاق DRL-CLBA: هجوم خلفي نظيف يهدد تصنيف الصوت باستخدام تعلم التعزيز

أركايف للذكاءمنذ 17 يوم
👁 1
كاپ-X: إطار زمني للتحسين القياسي لوكلاء البرمجة في التحكم الروبوتي
روبوتات

كاپ-X: إطار زمني للتحسين القياسي لوكلاء البرمجة في التحكم الروبوتي

أركايف للذكاءمنذ 17 يوم
ثورة التعلم التعزيزي: طريقة جديدة لتحليل البيانات بدون احتماليات!
أبحاث

ثورة التعلم التعزيزي: طريقة جديدة لتحليل البيانات بدون احتماليات!

أركايف للذكاءمنذ 17 يوم
👁 2
ثورة في التعلم الآلي: كيف يساهم التعاون البشري في تجاوز تحديات النمذجة؟
أبحاث

ثورة في التعلم الآلي: كيف يساهم التعاون البشري في تجاوز تحديات النمذجة؟

أركايف للذكاءمنذ 18 يوم
ابتكار جديد في مجال تعلم التعزيز: تقنية TraCeS لضمان السلامة في الذكاء الاصطناعي!
أبحاث

ابتكار جديد في مجال تعلم التعزيز: تقنية TraCeS لضمان السلامة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 19 يوم