Ailoxa Logo

🏷️ #أمان

272 مقال

استراتيجية استكشاف ثغرات نماذج اللغات الضخمة: مخاطر وهجمات وحلول مبتكرة!
أبحاث

استراتيجية استكشاف ثغرات نماذج اللغات الضخمة: مخاطر وهجمات وحلول مبتكرة!

أركايف للذكاءمنذ 2 شهر
أمان الوكلاء: إعادة التفكير في التوافق مع الأفعال في عصر الذكاء الاصطناعي
أبحاث

أمان الوكلاء: إعادة التفكير في التوافق مع الأفعال في عصر الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
👁 1
كيف تضمن أمان وكيل الذكاء الاصطناعي في رعاية الصحة؟ اكتشافات مثيرة من العمل الآمن
أبحاث

كيف تضمن أمان وكيل الذكاء الاصطناعي في رعاية الصحة؟ اكتشافات مثيرة من العمل الآمن

أركايف للذكاءمنذ 2 شهر
👁 3
هل يمكن أن تخذلنا الأبواب المرنة؟ تحليل عميق لأخطاء الوكالة في نماذج اللغات الضخمة
أبحاث

هل يمكن أن تخذلنا الأبواب المرنة؟ تحليل عميق لأخطاء الوكالة في نماذج اللغات الضخمة

أركايف للذكاءمنذ 2 شهر
👁 3
تحكم شامل في تنفيذ الوكلاء: تعزيز أمان الأنظمة بأسلوب بروتوكول سياق النموذج
أبحاث

تحكم شامل في تنفيذ الوكلاء: تعزيز أمان الأنظمة بأسلوب بروتوكول سياق النموذج

أركايف للذكاءمنذ 2 شهر
اكتشاف النقاط العمياء في أمان نماذج اللغة: تقنيات جديدة للتصدي للهجمات
أبحاث

اكتشاف النقاط العمياء في أمان نماذج اللغة: تقنيات جديدة للتصدي للهجمات

أركايف للذكاءمنذ 2 شهر
👁 1
تراجع الحوكمة: كيف تؤدي عملية ضغط السياق إلى فقدان قيود السلامة في نماذج LLM طويلة الأمد
أبحاث

تراجع الحوكمة: كيف تؤدي عملية ضغط السياق إلى فقدان قيود السلامة في نماذج LLM طويلة الأمد

أركايف للذكاءمنذ 2 شهر
👁 3
تطور ثوري في الذكاء الاصطناعي: تحسين توازن الأمان والكفاءة عبر التعلم السياقي الآمن القابل للتكيف!
نماذج لغوية

تطور ثوري في الذكاء الاصطناعي: تحسين توازن الأمان والكفاءة عبر التعلم السياقي الآمن القابل للتكيف!

أركايف للذكاءمنذ 2 شهر
دراسة جديدة تكشف: حماية النماذج اللغوية من هجمات إدخال الأوامر مستحيلة!
أبحاث

دراسة جديدة تكشف: حماية النماذج اللغوية من هجمات إدخال الأوامر مستحيلة!

أركايف للذكاءمنذ 2 شهر
👁 1
DMind Benchmark: تقييم شامل لجهود نماذج اللغات الضخمة في عالم Web3
أبحاث

DMind Benchmark: تقييم شامل لجهود نماذج اللغات الضخمة في عالم Web3

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة جديدة في التعلم الفيدرالي: خوارزمية WFAgg لمواجهة هجمات بيزنطية!
أبحاث

ثورة جديدة في التعلم الفيدرالي: خوارزمية WFAgg لمواجهة هجمات بيزنطية!

أركايف للذكاءمنذ 2 شهر
👁 1
أمان وفعالية في التعلم المعزز مع نظام هرمي متعدد الوكلاء
أبحاث

أمان وفعالية في التعلم المعزز مع نظام هرمي متعدد الوكلاء

أركايف للذكاءمنذ 2 شهر
👁 1
احصل على الأمان الكامل مع أدوات Daybreak الجديدة من OpenAI!
أدوات

احصل على الأمان الكامل مع أدوات Daybreak الجديدة من OpenAI!

مدونة أوبن إيه آيمنذ 2 شهر
👁 2
اكتشف CRAX: ثورة في قياس أمان التعلم المعزز بسرعة تفوق 100 مرة!
أبحاث

اكتشف CRAX: ثورة في قياس أمان التعلم المعزز بسرعة تفوق 100 مرة!

أركايف للذكاءمنذ 2 شهر
من البناء إلى الحقن: بصمات أصابع قائمة على التحرير لحماية نماذج اللغة الضخمة
أبحاث

من البناء إلى الحقن: بصمات أصابع قائمة على التحرير لحماية نماذج اللغة الضخمة

أركايف للذكاءمنذ 2 شهر
أتمتة الاستشارات المعتمدة على التنفيذ: إطار مبتكر لتأمين الذكاء الاصطناعي الفعّال
أبحاث

أتمتة الاستشارات المعتمدة على التنفيذ: إطار مبتكر لتأمين الذكاء الاصطناعي الفعّال

أركايف للذكاءمنذ 2 شهر
👁 1
تعرف على SciRisk-Bench: معيار جديد لتقييم سلامة الذكاء الاصطناعي في الأبحاث العلمية!
أبحاث

تعرف على SciRisk-Bench: معيار جديد لتقييم سلامة الذكاء الاصطناعي في الأبحاث العلمية!

أركايف للذكاءمنذ 2 شهر
👁 1
SafeClawBench: معيار جديد لفهم أمان الوكالات اللغوية باستخدام الأدوات
أبحاث

SafeClawBench: معيار جديد لفهم أمان الوكالات اللغوية باستخدام الأدوات

أركايف للذكاءمنذ 2 شهر
👁 1
دليل NVIDIA SkillSpector: فحص مهارات الذكاء الاصطناعي لرصد المخاطر الأمنية بطريقة مبتكرة
أبحاث

دليل NVIDIA SkillSpector: فحص مهارات الذكاء الاصطناعي لرصد المخاطر الأمنية بطريقة مبتكرة

مارك تيك بوستمنذ 2 شهر
OSGuard: المعيار الجديد لضمان سلامة الوكلاء العاملين على الكمبيوتر!
أخلاقيات الذكاء الاصطناعي

OSGuard: المعيار الجديد لضمان سلامة الوكلاء العاملين على الكمبيوتر!

أركايف للذكاءمنذ 2 شهر
👁 1