Ailoxa Logo

🏷️ #التعلم المعزز

577 مقال

Gimitest: أداة شاملة لإختبار سياسات التعلم المعزز بأساليب مبتكرة
أدوات

Gimitest: أداة شاملة لإختبار سياسات التعلم المعزز بأساليب مبتكرة

أركايف للذكاءمنذ 12 يوم
اكتشاف طريقة ORCAID: ثورة جديدة في تفسير سياسات التعلم المعزز!
أبحاث

اكتشاف طريقة ORCAID: ثورة جديدة في تفسير سياسات التعلم المعزز!

أركايف للذكاءمنذ 12 يوم
استخدام التعلم المعزز في كشف تلاعب الأسعار: من يحقق الأداء الأفضل؟
أبحاث

استخدام التعلم المعزز في كشف تلاعب الأسعار: من يحقق الأداء الأفضل؟

أركايف للذكاءمنذ 12 يوم
👁 2
من مراقب سلبي إلى ناقد نشط: كيف يُحفز التعلم المعزز التفكير المنهجي في التحكم الروبوتي؟
روبوتات

من مراقب سلبي إلى ناقد نشط: كيف يُحفز التعلم المعزز التفكير المنهجي في التحكم الروبوتي؟

أركايف للذكاءمنذ 13 يوم
👁 1
تعلم السيطرة على وكلاء النموذج اللغوي الضخم: ثورة في الذكاء الاصطناعي باستخدام التعلم المعزز
أبحاث

تعلم السيطرة على وكلاء النموذج اللغوي الضخم: ثورة في الذكاء الاصطناعي باستخدام التعلم المعزز

أركايف للذكاءمنذ 13 يوم
نموذج العالم: التعريف والطريق نحو مستقبل الذكاء الاصطناعي
أبحاث

نموذج العالم: التعريف والطريق نحو مستقبل الذكاء الاصطناعي

أركايف للذكاءمنذ 13 يوم
تحسين جودة نماذج العمليات المولدة بواسطة الذكاء الاصطناعي: دور تصميم دالة المكافأة
أبحاث

تحسين جودة نماذج العمليات المولدة بواسطة الذكاء الاصطناعي: دور تصميم دالة المكافأة

أركايف للذكاءمنذ 13 يوم
👁 1
هل يمكنك التعلم دون مكافأة؟ اكتشاف مسافة العمل الأدنى في العمليات المعقدة!
أبحاث

هل يمكنك التعلم دون مكافأة؟ اكتشاف مسافة العمل الأدنى في العمليات المعقدة!

أركايف للذكاءمنذ 13 يوم
👁 1
OpenTinker: ثورة جديدة في تدريب نماذج الذكاء الاصطناعي من خلال الفصل بين المهام!
أبحاث

OpenTinker: ثورة جديدة في تدريب نماذج الذكاء الاصطناعي من خلال الفصل بين المهام!

أركايف للذكاءمنذ 14 يوم
👁 1
LLM كمدرس: تقديم إطار مبتكر لتكييف التحفيزات في التعلم المعزز
أبحاث

LLM كمدرس: تقديم إطار مبتكر لتكييف التحفيزات في التعلم المعزز

أركايف للذكاءمنذ 14 يوم
👁 2
ابتكار ثوري: R²PO يغير قواعد لعبة التعلم المعزز في نماذج اللغات الضخمة!
أبحاث

ابتكار ثوري: R²PO يغير قواعد لعبة التعلم المعزز في نماذج اللغات الضخمة!

أركايف للذكاءمنذ 14 يوم
👁 1
ثورة في التعلم المعزز: كيف تعزز الأخطاء من تجربة الافتراضية دون الاعتماد على المراجع؟
أبحاث

ثورة في التعلم المعزز: كيف تعزز الأخطاء من تجربة الافتراضية دون الاعتماد على المراجع؟

أركايف للذكاءمنذ 14 يوم
👁 1
ثورة في تحسين الأداء: استخدام التعلم المعزز لتطبيق تقنيات الحزمة التكيفية
أبحاث

ثورة في تحسين الأداء: استخدام التعلم المعزز لتطبيق تقنيات الحزمة التكيفية

أركايف للذكاءمنذ 14 يوم
اكتشاف عقل الروبوت: كيف يُحسِّن VLA Grounder أداء النماذج الذكية باستخدام اللغة!
روبوتات

اكتشاف عقل الروبوت: كيف يُحسِّن VLA Grounder أداء النماذج الذكية باستخدام اللغة!

أركايف للذكاءمنذ 14 يوم
👁 1
ثورة في تسعير خدمات السكك الحديدية: تعلم تعزيز متعدد الوكلاء باستخدام الشبكات الديناميكية!
أبحاث

ثورة في تسعير خدمات السكك الحديدية: تعلم تعزيز متعدد الوكلاء باستخدام الشبكات الديناميكية!

أركايف للذكاءمنذ 14 يوم
حظوظ الأذكى: نموذج HASE تطور ذاتي يغير قواعد اللعبة في الذكاء الاصطناعي!
نماذج لغوية

حظوظ الأذكى: نموذج HASE تطور ذاتي يغير قواعد اللعبة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 14 يوم
👁 1
استراتيجية مبتكرة لتعزيز التعلم المعزز: تعرف على ProGPO!
أبحاث

استراتيجية مبتكرة لتعزيز التعلم المعزز: تعرف على ProGPO!

أركايف للذكاءمنذ 14 يوم
👁 1
CARL: ثورة جديدة في التخطيط الذكي باستخدام التعلم المعزز الواعي بالقيود!
أبحاث

CARL: ثورة جديدة في التخطيط الذكي باستخدام التعلم المعزز الواعي بالقيود!

أركايف للذكاءمنذ 14 يوم
CONFLUX: نموذج ثوري لتوليد صور الأشعة المقطعية ثلاثية الأبعاد باستخدام التعلم المعزز!
أبحاث

CONFLUX: نموذج ثوري لتوليد صور الأشعة المقطعية ثلاثية الأبعاد باستخدام التعلم المعزز!

أركايف للذكاءمنذ 14 يوم
SOV-CAD: حل مبتكر لإعادة بناء تسلسلات التصميم بمساعدة الكمبيوتر بطريقة ذكية!
أبحاث

SOV-CAD: حل مبتكر لإعادة بناء تسلسلات التصميم بمساعدة الكمبيوتر بطريقة ذكية!

أركايف للذكاءمنذ 14 يوم
👁 1