Ailoxa Logo

🏷️ #تعلم التعزيز

118 مقال

إطلاق PPO-HSC: إطار جديد لتعلم التعزيز يقضي على قيود نماذج اللغة الضخمة!
أبحاث

إطلاق PPO-HSC: إطار جديد لتعلم التعزيز يقضي على قيود نماذج اللغة الضخمة!

أركايف للذكاءمنذ 7 ساعة
OpenAI تكشف النقاب عن نموذج GPT-Red: تفوق ساحق على الفرق البشرية في اختبار الهجمات!
أبحاث

OpenAI تكشف النقاب عن نموذج GPT-Red: تفوق ساحق على الفرق البشرية في اختبار الهجمات!

مارك تيك بوستمنذ 4 يوم
اكتشاف الأسرار وراء سلوكيات الجماعات المعقدة من خلال مكافآت بسيطة
روبوتات

اكتشاف الأسرار وراء سلوكيات الجماعات المعقدة من خلال مكافآت بسيطة

أركايف للذكاءمنذ 6 يوم
من النقد إلى الثقة: انطلاقة CARE-PPO في تقدير الثقة للتنبؤات الكمية المعتمدة على اللغة
أبحاث

من النقد إلى الثقة: انطلاقة CARE-PPO في تقدير الثقة للتنبؤات الكمية المعتمدة على اللغة

أركايف للذكاءمنذ 6 يوم
تعلم التعزيز السياقي تحت الظروف غير الثابتة: دراسة شاملة تفتح آفاق جديدة
أبحاث

تعلم التعزيز السياقي تحت الظروف غير الثابتة: دراسة شاملة تفتح آفاق جديدة

أركايف للذكاءمنذ 6 يوم
👁 1
VINE: ثورة في التحكم التوليدي للذكاء الاصطناعي في تعلم التعزيز!
أبحاث

VINE: ثورة في التحكم التوليدي للذكاء الاصطناعي في تعلم التعزيز!

أركايف للذكاءمنذ 7 يوم
خطوات ثورية في تعلم التعزيز: تقنيات Q-Learning و Actor-Critic لسياسات أكثر Robustness!
أبحاث

خطوات ثورية في تعلم التعزيز: تقنيات Q-Learning و Actor-Critic لسياسات أكثر Robustness!

أركايف للذكاءمنذ 7 يوم
👁 1
ثورة الذكاء الاصطناعي في جدولة العمل: تعلم التعزيز المتكيف للتعامل مع الفجوات الزمنية
أبحاث

ثورة الذكاء الاصطناعي في جدولة العمل: تعلم التعزيز المتكيف للتعامل مع الفجوات الزمنية

أركايف للذكاءمنذ 7 يوم
👁 1
SETA: ثورة في تدريب وكلاء الذكاء الاصطناعي عبر بيئات قابلة للتحقق!
أبحاث

SETA: ثورة في تدريب وكلاء الذكاء الاصطناعي عبر بيئات قابلة للتحقق!

أركايف للذكاءمنذ 7 يوم
إعادة تعريف تعلم التعزيز متعدد الأهداف: اكتشاف استراتيجيات جديدة مع تقنيات D^3PO المتقدمة
أبحاث

إعادة تعريف تعلم التعزيز متعدد الأهداف: اكتشاف استراتيجيات جديدة مع تقنيات D^3PO المتقدمة

أركايف للذكاءمنذ 8 يوم
👁 1
تحسين أداء الشبكات باستخدام تعلم التعزيز: الاستجابة الذكية للتغيرات الديناميكية
أبحاث

تحسين أداء الشبكات باستخدام تعلم التعزيز: الاستجابة الذكية للتغيرات الديناميكية

أركايف للذكاءمنذ 11 يوم
👁 1
ثورة الذكاء الاصطناعي: تحسين كفاءة تعلم نماذج التفاعل البشري باستخدام استراتيجيات مبتكرة!
أبحاث

ثورة الذكاء الاصطناعي: تحسين كفاءة تعلم نماذج التفاعل البشري باستخدام استراتيجيات مبتكرة!

أركايف للذكاءمنذ 12 يوم
تحسين فعالية تعلم الآلة: استخدام التقنيات المعتمدة على التنبؤ القائم على الأقنعة
أبحاث

تحسين فعالية تعلم الآلة: استخدام التقنيات المعتمدة على التنبؤ القائم على الأقنعة

أركايف للذكاءمنذ 14 يوم
👁 1
قفزة نحو التكيف الفعال وتعزيز القوة في التعلم غير المشرف
أبحاث

قفزة نحو التكيف الفعال وتعزيز القوة في التعلم غير المشرف

أركايف للذكاءمنذ 14 يوم
👁 1
تعلم التعزيز القابل للتفسير: ثورة في إدارة إشارات المرور الذكية
أبحاث

تعلم التعزيز القابل للتفسير: ثورة في إدارة إشارات المرور الذكية

أركايف للذكاءمنذ 14 يوم
👁 1
ARLArena: إطار موحد لتعلم التعزيز الوكفي المستقر
أبحاث

ARLArena: إطار موحد لتعلم التعزيز الوكفي المستقر

أركايف للذكاءمنذ 14 يوم
👁 1
إطلاق DRL-CLBA: هجوم خلفي نظيف يهدد تصنيف الصوت باستخدام تعلم التعزيز
أبحاث

إطلاق DRL-CLBA: هجوم خلفي نظيف يهدد تصنيف الصوت باستخدام تعلم التعزيز

أركايف للذكاءمنذ 18 يوم
👁 1
كاپ-X: إطار زمني للتحسين القياسي لوكلاء البرمجة في التحكم الروبوتي
روبوتات

كاپ-X: إطار زمني للتحسين القياسي لوكلاء البرمجة في التحكم الروبوتي

أركايف للذكاءمنذ 18 يوم
ثورة التعلم التعزيزي: طريقة جديدة لتحليل البيانات بدون احتماليات!
أبحاث

ثورة التعلم التعزيزي: طريقة جديدة لتحليل البيانات بدون احتماليات!

أركايف للذكاءمنذ 18 يوم
👁 2
ثورة في التعلم الآلي: كيف يساهم التعاون البشري في تجاوز تحديات النمذجة؟
أبحاث

ثورة في التعلم الآلي: كيف يساهم التعاون البشري في تجاوز تحديات النمذجة؟

أركايف للذكاءمنذ 19 يوم