Ailoxa Logo

🏷️ #أمان الذكاء الاصطناعي

115 مقال

الأهمية كضعف: كيف يؤدي استرجاع المعلومات من الويب إلى تدهور الأمان في وكلاء النماذج اللغوية الضخمة؟
أبحاث

الأهمية كضعف: كيف يؤدي استرجاع المعلومات من الويب إلى تدهور الأمان في وكلاء النماذج اللغوية الضخمة؟

أركايف للذكاءمنذ 1 شهر
ثورة في أمان تحويل النص إلى صورة: كيف يضمن SafeDIG سلامة النتائج!
أبحاث

ثورة في أمان تحويل النص إلى صورة: كيف يضمن SafeDIG سلامة النتائج!

أركايف للذكاءمنذ 1 شهر
كيف تعزز تكنولوجيا التفكير بالصورة من أمان نماذج الذكاء الاصطناعي؟
أبحاث

كيف تعزز تكنولوجيا التفكير بالصورة من أمان نماذج الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
توازن جديد في أبحاث أمان الذكاء الاصطناعي: لماذا يجب تكثيف جهود الدفاع؟
أبحاث

توازن جديد في أبحاث أمان الذكاء الاصطناعي: لماذا يجب تكثيف جهود الدفاع؟

أركايف للذكاءمنذ 1 شهر
BarrierSteer: الحل الثوري لتعزيز أمان نماذج اللغة الكبيرة
أبحاث

BarrierSteer: الحل الثوري لتعزيز أمان نماذج اللغة الكبيرة

أركايف للذكاءمنذ 1 شهر
اكتشاف مذهل: agents التعلم المعزز المستندة إلى Infra-Bayesian تتفوق على الأساليب التقليدية في مواجهة التحديات الصعبة!
أبحاث

اكتشاف مذهل: agents التعلم المعزز المستندة إلى Infra-Bayesian تتفوق على الأساليب التقليدية في مواجهة التحديات الصعبة!

أركايف للذكاءمنذ 1 شهر
كلنا في خضم تحدي أمان الذكاء الاصطناعي — حتى جوجل!
أخلاقيات الذكاء الاصطناعي

كلنا في خضم تحدي أمان الذكاء الاصطناعي — حتى جوجل!

تيك كرانشمنذ 1 شهر
ثورة في أمان الذكاء الاصطناعي: بروتوكول HBHC لإلغاء الاعتماد الذاتي للوكالات الذكية!
أبحاث

ثورة في أمان الذكاء الاصطناعي: بروتوكول HBHC لإلغاء الاعتماد الذاتي للوكالات الذكية!

أركايف للذكاءمنذ 2 شهر
كشف التهديدات الذكية: تقنية جديدة لكشف المحفزات العدائية باستخدام تغييرات الانتروبيا
أبحاث

كشف التهديدات الذكية: تقنية جديدة لكشف المحفزات العدائية باستخدام تغييرات الانتروبيا

أركايف للذكاءمنذ 2 شهر
فهم أمان الذكاء الاصطناعي العمومي: هل نحن مستعدون للخطوة التالية؟
أخلاقيات الذكاء الاصطناعي

فهم أمان الذكاء الاصطناعي العمومي: هل نحن مستعدون للخطوة التالية؟

أركايف للذكاءمنذ 2 شهر
من الرفض إلى التعافي: نهج نظرية التحكم لضمان سلامة الذكاء الاصطناعي التوليدي
أخلاقيات الذكاء الاصطناعي

من الرفض إلى التعافي: نهج نظرية التحكم لضمان سلامة الذكاء الاصطناعي التوليدي

أركايف للذكاءمنذ 2 شهر
ابتكار ثوري في أمان الذكاء الاصطناعي: نظام ADR يكشف ويستجيب لتحديات الأمان
أبحاث

ابتكار ثوري في أمان الذكاء الاصطناعي: نظام ADR يكشف ويستجيب لتحديات الأمان

أركايف للذكاءمنذ 2 شهر
أمان نماذج اللغات الضخمة: ثلاثي الطبقات لضمان التشغيل الآمن!
أخلاقيات الذكاء الاصطناعي

أمان نماذج اللغات الضخمة: ثلاثي الطبقات لضمان التشغيل الآمن!

أركايف للذكاءمنذ 2 شهر
👁 1
علامات مضادة للتقطير: كيفية حماية نماذج الذكاء الاصطناعي من الاستخدام غير المصرح به!
أبحاث

علامات مضادة للتقطير: كيفية حماية نماذج الذكاء الاصطناعي من الاستخدام غير المصرح به!

أركايف للذكاءمنذ 2 شهر
إزالة المعرفة المميزة: نهج ثوري لفهم فقدان المعلومات في نماذج اللغات الضخمة
أبحاث

إزالة المعرفة المميزة: نهج ثوري لفهم فقدان المعلومات في نماذج اللغات الضخمة

أركايف للذكاءمنذ 2 شهر
STRIDE-AI: الإطار الثوري لتقييم أمان الذكاء الاصطناعي التوليدي
أخلاقيات الذكاء الاصطناعي

STRIDE-AI: الإطار الثوري لتقييم أمان الذكاء الاصطناعي التوليدي

أركايف للذكاءمنذ 2 شهر
تحذير هام: زيادة خطر هجمات حقن الأوامر في وكيل الذكاء الاصطناعي بسبب السعي لتوضيح الغموض
أبحاث

تحذير هام: زيادة خطر هجمات حقن الأوامر في وكيل الذكاء الاصطناعي بسبب السعي لتوضيح الغموض

أركايف للذكاءمنذ 2 شهر
تحليل قوة نماذج الرؤية واللغة: كيف تؤثر ضغوطات الرموز البصرية على صمودها ضد الهجمات الشرسة؟
أبحاث

تحليل قوة نماذج الرؤية واللغة: كيف تؤثر ضغوطات الرموز البصرية على صمودها ضد الهجمات الشرسة؟

أركايف للذكاءمنذ 2 شهر
تحكم آمن في نماذج الذكاء الاصطناعي: استكشاف تقنية Graph-Regularized Sparse Autoencoders
أبحاث

تحكم آمن في نماذج الذكاء الاصطناعي: استكشاف تقنية Graph-Regularized Sparse Autoencoders

أركايف للذكاءمنذ 2 شهر
ابتكار بصمة مضادة للتكرار: تعزيز كشف نماذج الذكاء الاصطناعي بكفاءة فائقة
أبحاث

ابتكار بصمة مضادة للتكرار: تعزيز كشف نماذج الذكاء الاصطناعي بكفاءة فائقة

أركايف للذكاءمنذ 2 شهر