Ailoxa Logo

🏷️ #تعلم تعزيزي

63 مقال

كيف تؤثر topologia الشبكة ومعلومات الخصم على تعزيز التعاون في أنظمة التعلم التعزيزي متعدد الوكلاء؟
أبحاث

كيف تؤثر topologia الشبكة ومعلومات الخصم على تعزيز التعاون في أنظمة التعلم التعزيزي متعدد الوكلاء؟

أركايف للذكاءمنذ 2 يوم
RePolicy: ابتكار ثوري في استخدام التعلم التعزيزي لتأمين سلامة الوكلاء!
أبحاث

RePolicy: ابتكار ثوري في استخدام التعلم التعزيزي لتأمين سلامة الوكلاء!

أركايف للذكاءمنذ 8 يوم
👁 1
MetaRAG: ابتكار ثوري في تحسين السياسات القائمة على اعتقاد العمل للذكاء الاصطناعي
أبحاث

MetaRAG: ابتكار ثوري في تحسين السياسات القائمة على اعتقاد العمل للذكاء الاصطناعي

أركايف للذكاءمنذ 8 يوم
👁 1
اكتشف قوة VisionCoach في تعزيز التفكير الفيديوي المبني على الإدراك البصري!
أبحاث

اكتشف قوة VisionCoach في تعزيز التفكير الفيديوي المبني على الإدراك البصري!

أركايف للذكاءمنذ 9 يوم
👁 3
كيفية تحسين أنظمة العمل الذاتي: صيغ جديدة للتحكم القائم على التعلم
روبوتات

كيفية تحسين أنظمة العمل الذاتي: صيغ جديدة للتحكم القائم على التعلم

أركايف للذكاءمنذ 9 يوم
👁 2
الذكاء الاصطناعي والتعاطف: كيف يمكن للأنظمة الذكية فهم وتحديد الوكلاء من خلال الملاحظة؟
أبحاث

الذكاء الاصطناعي والتعاطف: كيف يمكن للأنظمة الذكية فهم وتحديد الوكلاء من خلال الملاحظة؟

أركايف للذكاءمنذ 9 يوم
👁 2
إطلاق AgentMercury: بيئات قابلة للتحقق لتسريع استراتيجيات الأعمال!
أبحاث

إطلاق AgentMercury: بيئات قابلة للتحقق لتسريع استراتيجيات الأعمال!

أركايف للذكاءمنذ 10 يوم
👁 1
ابتكار ثوري في التحكم بالروبوتات الناعمة: DiSA-IQL لحل تحديات التعلم offline!
روبوتات

ابتكار ثوري في التحكم بالروبوتات الناعمة: DiSA-IQL لحل تحديات التعلم offline!

أركايف للذكاءمنذ 16 يوم
👁 1
تكنولوجيا Search-G1: تعزيز وكالات البحث باستخدام مكافآت ذات أساس تمثيلي
أبحاث

تكنولوجيا Search-G1: تعزيز وكالات البحث باستخدام مكافآت ذات أساس تمثيلي

أركايف للذكاءمنذ 23 يوم
👁 2
إطلاق عِنان التعلم التعزيزي: استراتيجيات جديدة لتحسين الكفاءة والتحكم المستمر
أبحاث

إطلاق عِنان التعلم التعزيزي: استراتيجيات جديدة لتحسين الكفاءة والتحكم المستمر

أركايف للذكاءمنذ 24 يوم
👁 2
إطلاق ProDVI: إعادة تعريف تعزيز التعلم العميق لتسريع كفاءة التعليم
أبحاث

إطلاق ProDVI: إعادة تعريف تعزيز التعلم العميق لتسريع كفاءة التعليم

أركايف للذكاءمنذ 27 يوم
👁 2
تعلم التعليل في مواجهة التحديات الصعبة: تقنية Off-Context GRPO تكسر الحواجز! 🚀
أبحاث

تعلم التعليل في مواجهة التحديات الصعبة: تقنية Off-Context GRPO تكسر الحواجز! 🚀

أركايف للذكاءمنذ 1 شهر
👁 1
دليل مبتكر لتحسين التعلم التعزيزي: اكتشف DADiff
أبحاث

دليل مبتكر لتحسين التعلم التعزيزي: اكتشف DADiff

أركايف للذكاءمنذ 1 شهر
👁 1
تعرف على SOReL: ثورة جديدة في التعلم التعزيزي Offline بالكامل
أبحاث

تعرف على SOReL: ثورة جديدة في التعلم التعزيزي Offline بالكامل

أركايف للذكاءمنذ 1 شهر
إطلاق حدود عامة غير فارغة لتعميم التعلم التعزيزي مع مكافآت قابلة للتحقق
أبحاث

إطلاق حدود عامة غير فارغة لتعميم التعلم التعزيزي مع مكافآت قابلة للتحقق

أركايف للذكاءمنذ 1 شهر
👁 1
OOD-RL-Bench: الإطار الثوري لاكتشاف الحالات النادرة في تعلم التعزيز!
أبحاث

OOD-RL-Bench: الإطار الثوري لاكتشاف الحالات النادرة في تعلم التعزيز!

أركايف للذكاءمنذ 1 شهر
👁 1
نسخة سياسية جديدة تعتمد على تحسينات مثبتة: ثورة في منهجيات التعلم التعزيزي لنماذج اللغة الكبيرة!
أبحاث

نسخة سياسية جديدة تعتمد على تحسينات مثبتة: ثورة في منهجيات التعلم التعزيزي لنماذج اللغة الكبيرة!

أركايف للذكاءمنذ 1 شهر
👁 1
لا تدع المكاسب تتلاشى: تحليل الوزن المتغير للسياسات في التعلم التعزيزي!
أبحاث

لا تدع المكاسب تتلاشى: تحليل الوزن المتغير للسياسات في التعلم التعزيزي!

أركايف للذكاءمنذ 2 شهر
👁 1
تعلم الإمساك الماهر من توجيه تصنيفي محدود: كيف أحدثت تقنية GRIT ثورة في التحكم بالروبوتات!
روبوتات

تعلم الإمساك الماهر من توجيه تصنيفي محدود: كيف أحدثت تقنية GRIT ثورة في التحكم بالروبوتات!

أركايف للذكاءمنذ 2 شهر
👁 2
ثورة التعلم التعزيزي: كيف يمكن للذكاء الاصطناعي تحسين عملاء الكمبيوتر ذاتياً؟
روبوتات

ثورة التعلم التعزيزي: كيف يمكن للذكاء الاصطناعي تحسين عملاء الكمبيوتر ذاتياً؟

أركايف للذكاءمنذ 2 شهر
👁 1