Ailoxa Logo

🏷️ #تغذية راجعة بشرية

8 مقال

اكتشاف ثوري في التعلم المعزز: S2T-RLHF وتطبيقه لتحسين استقرار التعلم
أبحاث

اكتشاف ثوري في التعلم المعزز: S2T-RLHF وتطبيقه لتحسين استقرار التعلم

أركايف للذكاءمنذ 8 يوم
👁 1
كشف تحيزات هناجة المستخدمين: إطار تدقيق بيانات تفضيل التعلم المعزز من خلال التغذية الراجعة البشرية
أبحاث

كشف تحيزات هناجة المستخدمين: إطار تدقيق بيانات تفضيل التعلم المعزز من خلال التغذية الراجعة البشرية

أركايف للذكاءمنذ 9 يوم
👁 1
تحقيق أمان التعلم المعزز من خلال التعزيز الارتباطي: مفهوم الهيمنة العشوائية للسيطرة على المخاطر الطيفية!
أبحاث

تحقيق أمان التعلم المعزز من خلال التعزيز الارتباطي: مفهوم الهيمنة العشوائية للسيطرة على المخاطر الطيفية!

أركايف للذكاءمنذ 23 يوم
تعلم التعزيز القوي: تحسين نماذج اللغة من خلال التغذية الراجعة البشرية
أبحاث

تعلم التعزيز القوي: تحسين نماذج اللغة من خلال التغذية الراجعة البشرية

أركايف للذكاءمنذ 1 شهر
ثيميس: إطار الذكاء الاصطناعي القابل للتفسير للذكاء الاصطناعي التعزيزي مع تغذية راجعة بشرية
أبحاث

ثيميس: إطار الذكاء الاصطناعي القابل للتفسير للذكاء الاصطناعي التعزيزي مع تغذية راجعة بشرية

أركايف للذكاءمنذ 1 شهر
👁 3
إطار تقليل الندم في تعلم التفضيلات: ثورة جديدة في نماذج اللغة الضخمة
نماذج لغوية

إطار تقليل الندم في تعلم التفضيلات: ثورة جديدة في نماذج اللغة الضخمة

أركايف للذكاءمنذ 1 شهر
اكتشاف المهارات ذات الصلة دلاليًا: ثورة في التعلم التعزيزي عبر تغذية راجعة بشرية مبتكرة!
أبحاث

اكتشاف المهارات ذات الصلة دلاليًا: ثورة في التعلم التعزيزي عبر تغذية راجعة بشرية مبتكرة!

أركايف للذكاءمنذ 3 شهر
تعلم تلخيص المعلومات: كيف يعزز الذكاء الاصطناعي قدراته بفضل تغذية راجعة بشرية مذهلة!
نماذج لغوية

تعلم تلخيص المعلومات: كيف يعزز الذكاء الاصطناعي قدراته بفضل تغذية راجعة بشرية مذهلة!

مدونة أوبن إيه آيمنذ 71 شهر
👁 1