🏷️ #أمان
272 مقال
أبحاث
استراتيجية استكشاف ثغرات نماذج اللغات الضخمة: مخاطر وهجمات وحلول مبتكرة!
أركايف للذكاءمنذ 2 شهر
أبحاث
أمان الوكلاء: إعادة التفكير في التوافق مع الأفعال في عصر الذكاء الاصطناعي
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
كيف تضمن أمان وكيل الذكاء الاصطناعي في رعاية الصحة؟ اكتشافات مثيرة من العمل الآمن
أركايف للذكاءمنذ 2 شهر
👁 3أبحاث
هل يمكن أن تخذلنا الأبواب المرنة؟ تحليل عميق لأخطاء الوكالة في نماذج اللغات الضخمة
أركايف للذكاءمنذ 2 شهر
👁 3أبحاث
تحكم شامل في تنفيذ الوكلاء: تعزيز أمان الأنظمة بأسلوب بروتوكول سياق النموذج
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشاف النقاط العمياء في أمان نماذج اللغة: تقنيات جديدة للتصدي للهجمات
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تراجع الحوكمة: كيف تؤدي عملية ضغط السياق إلى فقدان قيود السلامة في نماذج LLM طويلة الأمد
أركايف للذكاءمنذ 2 شهر
👁 3نماذج لغوية
تطور ثوري في الذكاء الاصطناعي: تحسين توازن الأمان والكفاءة عبر التعلم السياقي الآمن القابل للتكيف!
أركايف للذكاءمنذ 2 شهر
أبحاث
دراسة جديدة تكشف: حماية النماذج اللغوية من هجمات إدخال الأوامر مستحيلة!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
DMind Benchmark: تقييم شامل لجهود نماذج اللغات الضخمة في عالم Web3
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
ثورة جديدة في التعلم الفيدرالي: خوارزمية WFAgg لمواجهة هجمات بيزنطية!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
أمان وفعالية في التعلم المعزز مع نظام هرمي متعدد الوكلاء
أركايف للذكاءمنذ 2 شهر
👁 1أدوات
احصل على الأمان الكامل مع أدوات Daybreak الجديدة من OpenAI!
مدونة أوبن إيه آيمنذ 2 شهر
👁 2أبحاث
اكتشف CRAX: ثورة في قياس أمان التعلم المعزز بسرعة تفوق 100 مرة!
أركايف للذكاءمنذ 2 شهر
أبحاث
من البناء إلى الحقن: بصمات أصابع قائمة على التحرير لحماية نماذج اللغة الضخمة
أركايف للذكاءمنذ 2 شهر
أبحاث
أتمتة الاستشارات المعتمدة على التنفيذ: إطار مبتكر لتأمين الذكاء الاصطناعي الفعّال
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تعرف على SciRisk-Bench: معيار جديد لتقييم سلامة الذكاء الاصطناعي في الأبحاث العلمية!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
SafeClawBench: معيار جديد لفهم أمان الوكالات اللغوية باستخدام الأدوات
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
دليل NVIDIA SkillSpector: فحص مهارات الذكاء الاصطناعي لرصد المخاطر الأمنية بطريقة مبتكرة
مارك تيك بوستمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
OSGuard: المعيار الجديد لضمان سلامة الوكلاء العاملين على الكمبيوتر!
أركايف للذكاءمنذ 2 شهر
👁 1