🏷️ #أمان النماذج
23 مقال
أبحاث
نموذج CASCADE: تحليل دفاع متعدد الطبقات في بروتوكول سياق النموذج (MCP)
أركايف للذكاءمنذ 17 ساعة
أبحاث
تحسين أمان نماذج اللغات الضخمة: من الاكتشاف إلى الرفض عبر تنظيم الدوائر الكهربائية
أركايف للذكاءمنذ 2 يوم
👁 1أبحاث
تكنولوجيا الفوّهات الدلالية: الحل الأمثل لمواجهة هجمات تعديل الإشارات في نماذج الذكاء الاصطناعي!
أركايف للذكاءمنذ 9 يوم
👁 1أبحاث
حادثة Hugging Face: اكتشافات OpenAI وخطوات تعزيز أمان نماذج الذكاء الاصطناعي
مدونة أوبن إيه آيمنذ 9 يوم
👁 1أبحاث
اكتشاف مفهوم "قرصنة الأمان" في تكبير أوقات الاستدلال لأفضل $N$!
أركايف للذكاءمنذ 10 يوم
👁 1نماذج لغوية
الرؤية القادمة في الذكاء الاصطناعي: CLEAR لتحسين أمان نماذج اللغات الكبيرة دون المساس بالكفاءة!
أركايف للذكاءمنذ 11 يوم
👁 1أبحاث
ثورة في أمان نماذج اللغة الكبيرة: كيف تمنع "Tripwire" هجمات الاختراق بشكل فعال!
أركايف للذكاءمنذ 18 يوم
👁 3أبحاث
هل يمكن للذكاء الاصطناعي أن يحمي مستخدميه؟ اكتشاف فعالية ResponseGuard في التصدي للردود الضارة!
أركايف للذكاءمنذ 1 شهر
أبحاث
إطلاق إطار عمل ثوري: كيفية تحسين نماذج الذكاء الاصطناعي لمواجهة التحديات الأمنية المعقدة!
أركايف للذكاءمنذ 1 شهر
👁 2أبحاث
Minionese: دراسة شاملة تكشف هشاشة أمان نماذج اللغات المتعددة!
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
اختراقات غير قابلة للكشف: كيف تخفي الأسرار في الأبعاد العالية؟
أركايف للذكاءمنذ 1 شهر
👁 2أبحاث
اكتشاف السلوكيات الخفية في نماذج اللغة: ثورة جديدة في الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
اكتشاف مبتكر: مجموعة بيانات شاملة لهجمات متعددة الوسائط على نماذج الرؤية واللغة!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تحدي الأمن: دراسة جديدة تكشف ثغرات خطيرة في نماذج الذكاء الاصطناعي Fable 5 وOpus 4.8
أركايف للذكاءمنذ 2 شهر
👁 4أبحاث
ثورة في الذكاء الاصطناعي: التنبؤ بسلوك نماذج التعلم قبل إطلاقها!
مدونة أوبن إيه آيمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
هل يمكننا حماية نماذج الذكاء الاصطناعي من الانصهار؟ اكتشفوا الحل المبتكر!
أركايف للذكاءمنذ 2 شهر
أبحاث
تعزيز نقل الهجمات العدائية في نماذج التعلم العميق للصور والنصوص عبر تصحيح التحيز الخاص بالنموذج البديل
أركايف للذكاءمنذ 2 شهر
أبحاث
تحدي الذكاء الاصطناعي: تمبربينش يكشف مقاومة نماذج اللغات الكبيرة للتلاعب!
أركايف للذكاءمنذ 3 شهر
👁 2أبحاث
D-Judge: ثورة في مواجهة هجمات اختراق نماذج الذكاء الاصطناعي متعددة المراحل!
أركايف للذكاءمنذ 3 شهر
👁 1أبحاث
تحصين نماذج اللغة: استراتيجيات فعّالة لمواجهة الهجمات الضارة باستخدام إعادة الكتابة
أركايف للذكاءمنذ 3 شهر
1 / 2التالي →
