🏷️ #سلامة النماذج
8 مقال
أبحاث
تحديات سلامة أنظمة LLM متعددة الوكلاء: استراتيجيات جديدة لفهم المخاطر
أركايف للذكاءمنذ 11 يوم
👁 2أبحاث
تحليل جديد يكشف ضعف نماذج اللغة الكبيرة في منع المخاطر: هل تُعتبر سلامة الذكاء الاصطناعي مجرد وهم؟
أركايف للذكاءمنذ 19 يوم
👁 1نماذج لغوية
عندما تفشل التفضيلات في التحول إلى حوافز: فجوة السلوك في نماذج اللغات الضخمة
أركايف للذكاءمنذ 26 يوم
أبحاث
خطر الإطراء: كيف تتدهور سلامة نماذج الذكاء الاصطناعي عبر اللغات والمواضيع؟
أركايف للذكاءمنذ 1 شهر
أبحاث
لماذا تتدهور سلامة نماذج الذكاء الاصطناعي عبر اللغات؟ اكتشافات جديدة تكشف المستور!
أركايف للذكاءمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
هل يصبح الذكاء الاصطناعي أخطر من مفيد؟ تحليل جديد لتوازن الأخلاق والأمان في نماذج اللغات الضخمة
أركايف للذكاءمنذ 3 شهر
👁 1أبحاث
تحديات تقييم سلامة نماذج الذكاء الاصطناعي: لماذا لا تكفي الطرق التقليدية؟
أركايف للذكاءمنذ 3 شهر
أبحاث
تعزيز سلوك النماذج بأمان باستخدام مكافآت قائمة على القواعد!
مدونة أوبن إيه آيمنذ 24 شهر
