Ailoxa Logo

🏷️ #أمان النماذج

23 مقال

نموذج CASCADE: تحليل دفاع متعدد الطبقات في بروتوكول سياق النموذج (MCP)
أبحاث

نموذج CASCADE: تحليل دفاع متعدد الطبقات في بروتوكول سياق النموذج (MCP)

أركايف للذكاءمنذ 17 ساعة
تحسين أمان نماذج اللغات الضخمة: من الاكتشاف إلى الرفض عبر تنظيم الدوائر الكهربائية
أبحاث

تحسين أمان نماذج اللغات الضخمة: من الاكتشاف إلى الرفض عبر تنظيم الدوائر الكهربائية

أركايف للذكاءمنذ 2 يوم
👁 1
تكنولوجيا الفوّهات الدلالية: الحل الأمثل لمواجهة هجمات تعديل الإشارات في نماذج الذكاء الاصطناعي!
أبحاث

تكنولوجيا الفوّهات الدلالية: الحل الأمثل لمواجهة هجمات تعديل الإشارات في نماذج الذكاء الاصطناعي!

أركايف للذكاءمنذ 9 يوم
👁 1
حادثة Hugging Face: اكتشافات OpenAI وخطوات تعزيز أمان نماذج الذكاء الاصطناعي
أبحاث

حادثة Hugging Face: اكتشافات OpenAI وخطوات تعزيز أمان نماذج الذكاء الاصطناعي

مدونة أوبن إيه آيمنذ 9 يوم
👁 1
اكتشاف مفهوم "قرصنة الأمان" في تكبير أوقات الاستدلال لأفضل $N$!
أبحاث

اكتشاف مفهوم "قرصنة الأمان" في تكبير أوقات الاستدلال لأفضل $N$!

أركايف للذكاءمنذ 10 يوم
👁 1
الرؤية القادمة في الذكاء الاصطناعي: CLEAR لتحسين أمان نماذج اللغات الكبيرة دون المساس بالكفاءة!
نماذج لغوية

الرؤية القادمة في الذكاء الاصطناعي: CLEAR لتحسين أمان نماذج اللغات الكبيرة دون المساس بالكفاءة!

أركايف للذكاءمنذ 11 يوم
👁 1
ثورة في أمان نماذج اللغة الكبيرة: كيف تمنع "Tripwire" هجمات الاختراق بشكل فعال!
أبحاث

ثورة في أمان نماذج اللغة الكبيرة: كيف تمنع "Tripwire" هجمات الاختراق بشكل فعال!

أركايف للذكاءمنذ 18 يوم
👁 3
هل يمكن للذكاء الاصطناعي أن يحمي مستخدميه؟ اكتشاف فعالية ResponseGuard في التصدي للردود الضارة!
أبحاث

هل يمكن للذكاء الاصطناعي أن يحمي مستخدميه؟ اكتشاف فعالية ResponseGuard في التصدي للردود الضارة!

أركايف للذكاءمنذ 1 شهر
إطلاق إطار عمل ثوري: كيفية تحسين نماذج الذكاء الاصطناعي لمواجهة التحديات الأمنية المعقدة!
أبحاث

إطلاق إطار عمل ثوري: كيفية تحسين نماذج الذكاء الاصطناعي لمواجهة التحديات الأمنية المعقدة!

أركايف للذكاءمنذ 1 شهر
👁 2
Minionese: دراسة شاملة تكشف هشاشة أمان نماذج اللغات المتعددة!
أبحاث

Minionese: دراسة شاملة تكشف هشاشة أمان نماذج اللغات المتعددة!

أركايف للذكاءمنذ 1 شهر
👁 1
اختراقات غير قابلة للكشف: كيف تخفي الأسرار في الأبعاد العالية؟
أبحاث

اختراقات غير قابلة للكشف: كيف تخفي الأسرار في الأبعاد العالية؟

أركايف للذكاءمنذ 1 شهر
👁 2
اكتشاف السلوكيات الخفية في نماذج اللغة: ثورة جديدة في الذكاء الاصطناعي!
أبحاث

اكتشاف السلوكيات الخفية في نماذج اللغة: ثورة جديدة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
👁 1
اكتشاف مبتكر: مجموعة بيانات شاملة لهجمات متعددة الوسائط على نماذج الرؤية واللغة!
أبحاث

اكتشاف مبتكر: مجموعة بيانات شاملة لهجمات متعددة الوسائط على نماذج الرؤية واللغة!

أركايف للذكاءمنذ 2 شهر
👁 1
تحدي الأمن: دراسة جديدة تكشف ثغرات خطيرة في نماذج الذكاء الاصطناعي Fable 5 وOpus 4.8
أبحاث

تحدي الأمن: دراسة جديدة تكشف ثغرات خطيرة في نماذج الذكاء الاصطناعي Fable 5 وOpus 4.8

أركايف للذكاءمنذ 2 شهر
👁 4
ثورة في الذكاء الاصطناعي: التنبؤ بسلوك نماذج التعلم قبل إطلاقها!
أبحاث

ثورة في الذكاء الاصطناعي: التنبؤ بسلوك نماذج التعلم قبل إطلاقها!

مدونة أوبن إيه آيمنذ 2 شهر
هل يمكننا حماية نماذج الذكاء الاصطناعي من الانصهار؟ اكتشفوا الحل المبتكر!
أخلاقيات الذكاء الاصطناعي

هل يمكننا حماية نماذج الذكاء الاصطناعي من الانصهار؟ اكتشفوا الحل المبتكر!

أركايف للذكاءمنذ 2 شهر
تعزيز نقل الهجمات العدائية في نماذج التعلم العميق للصور والنصوص عبر تصحيح التحيز الخاص بالنموذج البديل
أبحاث

تعزيز نقل الهجمات العدائية في نماذج التعلم العميق للصور والنصوص عبر تصحيح التحيز الخاص بالنموذج البديل

أركايف للذكاءمنذ 2 شهر
تحدي الذكاء الاصطناعي: تمبربينش يكشف مقاومة نماذج اللغات الكبيرة للتلاعب!
أبحاث

تحدي الذكاء الاصطناعي: تمبربينش يكشف مقاومة نماذج اللغات الكبيرة للتلاعب!

أركايف للذكاءمنذ 3 شهر
👁 2
D-Judge: ثورة في مواجهة هجمات اختراق نماذج الذكاء الاصطناعي متعددة المراحل!
أبحاث

D-Judge: ثورة في مواجهة هجمات اختراق نماذج الذكاء الاصطناعي متعددة المراحل!

أركايف للذكاءمنذ 3 شهر
👁 1
تحصين نماذج اللغة: استراتيجيات فعّالة لمواجهة الهجمات الضارة باستخدام إعادة الكتابة
أبحاث

تحصين نماذج اللغة: استراتيجيات فعّالة لمواجهة الهجمات الضارة باستخدام إعادة الكتابة

أركايف للذكاءمنذ 3 شهر