Ailoxa Logo

🏷️ #أمان الذكاء الاصطناعي

115 مقال

كيف تحبط هجمات حقن الأوامر كفاءة وكالات الذكاء الاصطناعي؟
أبحاث

كيف تحبط هجمات حقن الأوامر كفاءة وكالات الذكاء الاصطناعي؟

وايردمنذ 2 يوم
👁 2
حماية الذكاء الاصطناعي: النموذج الثوري Safety Sentry لتفادي الأخطاء البشرية!
أبحاث

حماية الذكاء الاصطناعي: النموذج الثوري Safety Sentry لتفادي الأخطاء البشرية!

أركايف للذكاءمنذ 4 يوم
👁 1
تعرف على GPT-Red: هاكر فائق من OpenAI لتعزيز أمان نماذج الذكاء الاصطناعي
شركات

تعرف على GPT-Red: هاكر فائق من OpenAI لتعزيز أمان نماذج الذكاء الاصطناعي

MIT للتقنيةمنذ 4 يوم
خرائط الشخصية: اكتشاف سمات نماذج اللغة في عالم الذكاء الاصطناعي
أبحاث

خرائط الشخصية: اكتشاف سمات نماذج اللغة في عالم الذكاء الاصطناعي

أركايف للذكاءمنذ 10 يوم
👁 1
ثورة الذكاء الاصطناعي في التأمين التجاري: نظام جديد يضمن الأمان والموثوقية!
روبوتات

ثورة الذكاء الاصطناعي في التأمين التجاري: نظام جديد يضمن الأمان والموثوقية!

أركايف للذكاءمنذ 12 يوم
👁 1
ثورة أمن تنفيذ الذكاء الاصطناعي: دراسة جديدة تكشف عن نقاط ضعف خطيرة!
أبحاث

ثورة أمن تنفيذ الذكاء الاصطناعي: دراسة جديدة تكشف عن نقاط ضعف خطيرة!

أركايف للذكاءمنذ 12 يوم
نظام تصفية السياق: حماية نماذج اللغة الكبيرة من الهجمات الخبيثة
أبحاث

نظام تصفية السياق: حماية نماذج اللغة الكبيرة من الهجمات الخبيثة

أركايف للذكاءمنذ 13 يوم
👁 2
كيف نتجنب النقاش: أمان الذكاء الاصطناعي القابل للتوسع من خلال براهين تفاعلية فعالة مرتين
أبحاث

كيف نتجنب النقاش: أمان الذكاء الاصطناعي القابل للتوسع من خلال براهين تفاعلية فعالة مرتين

أركايف للذكاءمنذ 13 يوم
تقنيات تأمين الذكاء الاصطناعي: كيف يتم تنشيط أنظمة الحماية عن طريق المراقبة السلوكية؟
أبحاث

تقنيات تأمين الذكاء الاصطناعي: كيف يتم تنشيط أنظمة الحماية عن طريق المراقبة السلوكية؟

أركايف للذكاءمنذ 17 يوم
👁 1
تطور جديد في أمان نماذج الذكاء الاصطناعي: Introducing CASE-Bench!
أبحاث

تطور جديد في أمان نماذج الذكاء الاصطناعي: Introducing CASE-Bench!

أركايف للذكاءمنذ 20 يوم
كشف النقاب عن ميزات خطيرة تخترق نماذج اللغة: كيف تتجنب الهجمات تجاوز الأمان؟
أبحاث

كشف النقاب عن ميزات خطيرة تخترق نماذج اللغة: كيف تتجنب الهجمات تجاوز الأمان؟

أركايف للذكاءمنذ 21 يوم
👁 1
الفجوة غير الانتباهية: كيف يؤدي التركيز الضيق إلى تجاهل إشارات السلامة الحيوية في نماذج الذكاء الاصطناعي
أبحاث

الفجوة غير الانتباهية: كيف يؤدي التركيز الضيق إلى تجاهل إشارات السلامة الحيوية في نماذج الذكاء الاصطناعي

أركايف للذكاءمنذ 24 يوم
👁 1
هل الضمانات الأمنية في الشبكات العصبية آمنة؟ اكتشف كيفية حساب الشهادات القابلة للثقة!
أبحاث

هل الضمانات الأمنية في الشبكات العصبية آمنة؟ اكتشف كيفية حساب الشهادات القابلة للثقة!

أركايف للذكاءمنذ 26 يوم
👁 1
اكتشاف تفكير نماذج اللغة الخاطئ: كيف نتأكد من سلامة الذكاء الاصطناعي؟
أبحاث

اكتشاف تفكير نماذج اللغة الخاطئ: كيف نتأكد من سلامة الذكاء الاصطناعي؟

أركايف للذكاءمنذ 26 يوم
👁 1
تحديات أمان نماذج اللغات الضخمة (LLM): اختبار تطورات الذكاء الاصطناعي في أنظمة سلامة حرجة
أبحاث

تحديات أمان نماذج اللغات الضخمة (LLM): اختبار تطورات الذكاء الاصطناعي في أنظمة سلامة حرجة

أركايف للذكاءمنذ 1 شهر
هل يختار الذكاء الاصطناعي أدوات بامتيازات زائدة؟ اكتشافات مثيرة في عالم الوكالات اللغوية!
أبحاث

هل يختار الذكاء الاصطناعي أدوات بامتيازات زائدة؟ اكتشافات مثيرة في عالم الوكالات اللغوية!

أركايف للذكاءمنذ 1 شهر
SafeSpec: حلول مبتكرة لضمان الأمان والكفاءة في نماذج اللغات الضخمة
نماذج لغوية

SafeSpec: حلول مبتكرة لضمان الأمان والكفاءة في نماذج اللغات الضخمة

أركايف للذكاءمنذ 1 شهر
دمج التغيرات التوزيعية وأمان الذكاء الاصطناعي: تعاون مثير بين المفاهيم والأساليب!
أبحاث

دمج التغيرات التوزيعية وأمان الذكاء الاصطناعي: تعاون مثير بين المفاهيم والأساليب!

أركايف للذكاءمنذ 1 شهر
حقيقة مفزعة: التدخلات باستخدام الـ SAE غير موثوقة، وعودة السلوكيات المكبوحة!
أبحاث

حقيقة مفزعة: التدخلات باستخدام الـ SAE غير موثوقة، وعودة السلوكيات المكبوحة!

أركايف للذكاءمنذ 1 شهر
البيت الأبيض يُطالب أنثروبيك بوقف جميع الثغرات الأمنية: هل الأمر ممكن حقاً؟
أخلاقيات الذكاء الاصطناعي

البيت الأبيض يُطالب أنثروبيك بوقف جميع الثغرات الأمنية: هل الأمر ممكن حقاً؟

وايردمنذ 1 شهر