Ailoxa Logo

🏷️ #سلامة النماذج

8 مقال

تحديات سلامة أنظمة LLM متعددة الوكلاء: استراتيجيات جديدة لفهم المخاطر
أبحاث

تحديات سلامة أنظمة LLM متعددة الوكلاء: استراتيجيات جديدة لفهم المخاطر

أركايف للذكاءمنذ 11 يوم
👁 2
تحليل جديد يكشف ضعف نماذج اللغة الكبيرة في منع المخاطر: هل تُعتبر سلامة الذكاء الاصطناعي مجرد وهم؟
أبحاث

تحليل جديد يكشف ضعف نماذج اللغة الكبيرة في منع المخاطر: هل تُعتبر سلامة الذكاء الاصطناعي مجرد وهم؟

أركايف للذكاءمنذ 19 يوم
👁 1
عندما تفشل التفضيلات في التحول إلى حوافز: فجوة السلوك في نماذج اللغات الضخمة
نماذج لغوية

عندما تفشل التفضيلات في التحول إلى حوافز: فجوة السلوك في نماذج اللغات الضخمة

أركايف للذكاءمنذ 26 يوم
خطر الإطراء: كيف تتدهور سلامة نماذج الذكاء الاصطناعي عبر اللغات والمواضيع؟
أبحاث

خطر الإطراء: كيف تتدهور سلامة نماذج الذكاء الاصطناعي عبر اللغات والمواضيع؟

أركايف للذكاءمنذ 1 شهر
لماذا تتدهور سلامة نماذج الذكاء الاصطناعي عبر اللغات؟ اكتشافات جديدة تكشف المستور!
أبحاث

لماذا تتدهور سلامة نماذج الذكاء الاصطناعي عبر اللغات؟ اكتشافات جديدة تكشف المستور!

أركايف للذكاءمنذ 2 شهر
هل يصبح الذكاء الاصطناعي أخطر من مفيد؟ تحليل جديد لتوازن الأخلاق والأمان في نماذج اللغات الضخمة
أخلاقيات الذكاء الاصطناعي

هل يصبح الذكاء الاصطناعي أخطر من مفيد؟ تحليل جديد لتوازن الأخلاق والأمان في نماذج اللغات الضخمة

أركايف للذكاءمنذ 3 شهر
👁 1
تحديات تقييم سلامة نماذج الذكاء الاصطناعي: لماذا لا تكفي الطرق التقليدية؟
أبحاث

تحديات تقييم سلامة نماذج الذكاء الاصطناعي: لماذا لا تكفي الطرق التقليدية؟

أركايف للذكاءمنذ 3 شهر
تعزيز سلوك النماذج بأمان باستخدام مكافآت قائمة على القواعد!
أبحاث

تعزيز سلوك النماذج بأمان باستخدام مكافآت قائمة على القواعد!

مدونة أوبن إيه آيمنذ 24 شهر