🏷️ #أمان الذكاء الاصطناعي
115 مقال
أبحاث
هجوم تسميم الحالات الخفية: كيف تهدد نماذج Mamba اللغوية؟
أركايف للذكاءمنذ 2 شهر
أبحاث
EVA: إطار مبتكر لتعزيز الأمان في نماذج الذكاء الاصطناعي ضد هجمات الاختراق!
أركايف للذكاءمنذ 2 شهر
أبحاث
تقييم حديث لأمان نماذج اللغات الضخمة: كيف تتعرض للهجمات المتكررة؟
أركايف للذكاءمنذ 2 شهر
أدوات
إصدار ثوري في توليد الصور: تقنية SPOT لرفاهية الأمان في التطبيقات الذكية
أركايف للذكاءمنذ 2 شهر
أبحاث
أفق أمان الذكاء الاصطناعي: كيف تساهم نماذج اللغات الكبيرة في سلامة الأنظمة الذكية؟
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
إهمال النفي: كيف تفشل نماذج الذكاء الاصطناعي في تعلم النفي أثناء التدريب!
أركايف للذكاءمنذ 2 شهر
أبحاث
ميتس: ثورة في اختراق نماذج اللغات الضخمة باستخدام استراتيجية التعلم الذاتي
أركايف للذكاءمنذ 2 شهر
أبحاث
خطط مثيرة: كيف تُدير نماذج اللغة الكبيرة (LLMs) الأفكار وتتلاعب بالإيقاع!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
CachePrune: تقنية مبتكرة لحماية نماذج اللغة الكبيرة من هجمات التعليمات غير المباشرة!
أركايف للذكاءمنذ 2 شهر
أبحاث
تحليل الشخصية الكامن: تعزيز الأمان دون الحاجة للإشارة إلى المخاطر
أركايف للذكاءمنذ 2 شهر
أبحاث
تحقق من الاحتواء: ضمانات أمان الذكاء الاصطناعي المستقلة عن المحاذاة
أركايف للذكاءمنذ 2 شهر
أبحاث
ابتكار ثوري: تحسين حمايات نماذج اللغة الكبيرة للكشف عن هجمات الاختراق
أركايف للذكاءمنذ 2 شهر
أبحاث
معايير إعادة الإنتاج: ضرورة لدعم ادعاءات أمان الذكاء الاصطناعي في نيوريبس
أركايف للذكاءمنذ 2 شهر
أبحاث
هل يمكن لـ Consensus Sampling أن تجعل الذكاء الاصطناعي أكثر أمانًا؟
أركايف للذكاءمنذ 2 شهر
أبحاث
BEAVER: الإطار الثوري للتحقق من أمان نماذج اللغة الكبيرة!
أركايف للذكاءمنذ 2 شهر
أبحاث
انفثينك: ثورة في أمان نماذج اللغة من خلال التفكير الاستباقي!
أركايف للذكاءمنذ 2 شهر
أبحاث
سلسلة المخاطر: كيف نفهم أوجه القصور في نماذج التفكير المعقد؟
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
نقاط ضعف نماذج اللغة الكبيرة (LLMs): هجمات رياضية تكشف المخاطر المخفية!
أركايف للذكاءمنذ 2 شهر
أبحاث
عندما تتعرض نماذج الحماية للانهيار: دراسة ثغرات النماذج الحارسة للذكاء الاصطناعي
أركايف للذكاءمنذ 2 شهر
أبحاث
هجوم العودة النظيف: أسلوب مبتكر لاستهداف نماذج الرؤية واللغة عبر نماذج الانتشار
أركايف للذكاءمنذ 2 شهر
