Ailoxa Logo

🏷️ #أمان الذكاء الاصطناعي

115 مقال

تحديات التنميط في نماذج اللغات الضخمة: نحو تنوع حقيقي لأمان الذكاء الاصطناعي
أبحاث

تحديات التنميط في نماذج اللغات الضخمة: نحو تنوع حقيقي لأمان الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
هل الحماية كافية؟ هجمات التلاعب على وكلاء نماذج اللغات الضخمة تثير القلق!
أبحاث

هل الحماية كافية؟ هجمات التلاعب على وكلاء نماذج اللغات الضخمة تثير القلق!

أركايف للذكاءمنذ 2 شهر
فتح أبواب جديدة: كيف تكسر نماذج اللغات الضخمة حواجز الأمان بخداع النوايا!
أبحاث

فتح أبواب جديدة: كيف تكسر نماذج اللغات الضخمة حواجز الأمان بخداع النوايا!

أركايف للذكاءمنذ 2 شهر
كشف أسرار نماذج اللغة: استراتيجيات متطورة للكشف عن نقاط الضعف في مواجهة الهجمات
أبحاث

كشف أسرار نماذج اللغة: استراتيجيات متطورة للكشف عن نقاط الضعف في مواجهة الهجمات

أركايف للذكاءمنذ 2 شهر
استكشاف إطار جيومتري معلوماتي لتحليل استقرار نماذج اللغات الضخمة تحت ضغط الغموض
أبحاث

استكشاف إطار جيومتري معلوماتي لتحليل استقرار نماذج اللغات الضخمة تحت ضغط الغموض

أركايف للذكاءمنذ 2 شهر
النموذج كيريموف-أليكبيرلي: ثورة في أمان الذكاء الاصطناعي من خلال الديناميكا الحرارية المعلوماتية
أبحاث

النموذج كيريموف-أليكبيرلي: ثورة في أمان الذكاء الاصطناعي من خلال الديناميكا الحرارية المعلوماتية

أركايف للذكاءمنذ 2 شهر
تعلم التعزيز مع تغذية راجعة متقدمة: ثورة في أمان نماذج اللغة الكبيرة!
أبحاث

تعلم التعزيز مع تغذية راجعة متقدمة: ثورة في أمان نماذج اللغة الكبيرة!

أركايف للذكاءمنذ 2 شهر
السماح بالتنفيذ: بروتوكول جديد لضمان أمان الأنظمة الذكية!
أبحاث

السماح بالتنفيذ: بروتوكول جديد لضمان أمان الأنظمة الذكية!

أركايف للذكاءمنذ 2 شهر
ثغرات في الدفاعات ضد هجمات حقن الطلبات على نماذج اللغات الضخمة: ضرورة الحذر!
أبحاث

ثغرات في الدفاعات ضد هجمات حقن الطلبات على نماذج اللغات الضخمة: ضرورة الحذر!

أركايف للذكاءمنذ 2 شهر
👁 2
اكتشاف آفاق جديدة في اختبار أمان نماذج اللغة: حل مشكلة Oracle التخطي
أبحاث

اكتشاف آفاق جديدة في اختبار أمان نماذج اللغة: حل مشكلة Oracle التخطي

أركايف للذكاءمنذ 2 شهر
تقدير مخاطر الذيل في نواتج نماذج اللغات: خطوة نحو أمان أكبر
أبحاث

تقدير مخاطر الذيل في نواتج نماذج اللغات: خطوة نحو أمان أكبر

أركايف للذكاءمنذ 2 شهر
ثورة في اختراق نماذج اللغة: تقنية LogiBreak تفتح الأبواب المغلقة!
أبحاث

ثورة في اختراق نماذج اللغة: تقنية LogiBreak تفتح الأبواب المغلقة!

أركايف للذكاءمنذ 2 شهر
تأمين الشبكات العصبية: استراتيجية جديدة للتحقق الاحتمالي لضمان السلامة!
أبحاث

تأمين الشبكات العصبية: استراتيجية جديدة للتحقق الاحتمالي لضمان السلامة!

أركايف للذكاءمنذ 2 شهر
إطلاق إطار عمل أمان الذكاء الاصطناعي من Mend: دليلك الشامل لحماية الأنظمة الذكية!
أخلاقيات الذكاء الاصطناعي

إطلاق إطار عمل أمان الذكاء الاصطناعي من Mend: دليلك الشامل لحماية الأنظمة الذكية!

مارك تيك بوستمنذ 2 شهر
كيف تؤثر البيئات العدائية على الذكاء الاصطناعي? تحليل مثير!
أبحاث

كيف تؤثر البيئات العدائية على الذكاء الاصطناعي? تحليل مثير!

أركايف للذكاءمنذ 3 شهر
هل يمكن لإعادة هيكلة التفكير أن تنقذ نماذج الذكاء الاصطناعي من الأخطاء القاتلة؟
أبحاث

هل يمكن لإعادة هيكلة التفكير أن تنقذ نماذج الذكاء الاصطناعي من الأخطاء القاتلة؟

أركايف للذكاءمنذ 3 شهر
تحقيق الأمان الفائق: Cat-DPO والذكاء الاصطناعي القابل للتكيف!
أخلاقيات الذكاء الاصطناعي

تحقيق الأمان الفائق: Cat-DPO والذكاء الاصطناعي القابل للتكيف!

أركايف للذكاءمنذ 3 شهر
👁 1
تحصين نماذج الذكاء الاصطناعي: كيفية مواجهة المخاطر الخفية من الهجمات المنسقة!
أبحاث

تحصين نماذج الذكاء الاصطناعي: كيفية مواجهة المخاطر الخفية من الهجمات المنسقة!

أركايف للذكاءمنذ 3 شهر
تحصينات رمزية لعملاء الذكاء الاصطناعي: أمان معزز دون المساس بالفعالية!
أبحاث

تحصينات رمزية لعملاء الذكاء الاصطناعي: أمان معزز دون المساس بالفعالية!

أركايف للذكاءمنذ 3 شهر
ابتكار ثوري: SelfGrader يكشف هجمات jailbreak على نماذج الذكاء الاصطناعي بشكل مذهل
أبحاث

ابتكار ثوري: SelfGrader يكشف هجمات jailbreak على نماذج الذكاء الاصطناعي بشكل مذهل

أركايف للذكاءمنذ 3 شهر