Ailoxa Logo

🏷️ #أمان الذكاء الاصطناعي

150 مقال

كيف يساهم التفكير المنطقي في حماية الذكاء الاصطناعي من الهجمات المستترة؟
أبحاث

كيف يساهم التفكير المنطقي في حماية الذكاء الاصطناعي من الهجمات المستترة؟

أركايف للذكاءمنذ 1 يوم
👁 1
إيفو فلينت: خريطة تطورية لفهم ضعف نماذج اللغة في التفاعل المتعدد
أبحاث

إيفو فلينت: خريطة تطورية لفهم ضعف نماذج اللغة في التفاعل المتعدد

أركايف للذكاءمنذ 1 يوم
👁 1
ثورة جديدة في تقييم الأمن: كيفية مقاومة jailbreak لنماذج اللغات الضخمة
أبحاث

ثورة جديدة في تقييم الأمن: كيفية مقاومة jailbreak لنماذج اللغات الضخمة

أركايف للذكاءمنذ 1 يوم
👁 1
تحديات الأمان في جيل المحتوى السمعي-البصري: دراسة جديدة حول Multi2AV-Safety
أبحاث

تحديات الأمان في جيل المحتوى السمعي-البصري: دراسة جديدة حول Multi2AV-Safety

أركايف للذكاءمنذ 6 يوم
إطلاق NeuronTune: ثورة في تحقيق التوازن بين الأمان والفائدة في نماذج اللغات الضخمة!
أبحاث

إطلاق NeuronTune: ثورة في تحقيق التوازن بين الأمان والفائدة في نماذج اللغات الضخمة!

أركايف للذكاءمنذ 8 يوم
GuardPaint: ثورة في أمان توليد الصور من النصوص لتحسين التحكم وإزالة المخاطر!
أبحاث

GuardPaint: ثورة في أمان توليد الصور من النصوص لتحسين التحكم وإزالة المخاطر!

أركايف للذكاءمنذ 9 يوم
كشف المستور: كيفية مواجهة خداع الدلالات عبر التحقق من النوايا الكامنة
أبحاث

كشف المستور: كيفية مواجهة خداع الدلالات عبر التحقق من النوايا الكامنة

أركايف للذكاءمنذ 10 يوم
👁 2
ثورة في أمان نماذج اللغات الضخمة: كشف مخاطر المحتوى الخطير باستخدام الديناميكيات المعقدة
أبحاث

ثورة في أمان نماذج اللغات الضخمة: كشف مخاطر المحتوى الخطير باستخدام الديناميكيات المعقدة

أركايف للذكاءمنذ 13 يوم
👁 1
تقييم جديد لهجمات اختراق النماذج اللغوية الضخمة: الكشف عن نجاحات غير عادلة!
أبحاث

تقييم جديد لهجمات اختراق النماذج اللغوية الضخمة: الكشف عن نجاحات غير عادلة!

أركايف للذكاءمنذ 15 يوم
👁 1
اكتشاف تسرب المعلومات من نماذج اللغة الكبيرة: LeakGauge في المقدمة!
أبحاث

اكتشاف تسرب المعلومات من نماذج اللغة الكبيرة: LeakGauge في المقدمة!

أركايف للذكاءمنذ 15 يوم
👁 2
أوبن أيه آي تعيد هيكلة بروتوكولات الأمان بعد خروج وكلائها عن السيطرة!
أخلاقيات الذكاء الاصطناعي

أوبن أيه آي تعيد هيكلة بروتوكولات الأمان بعد خروج وكلائها عن السيطرة!

وايردمنذ 16 يوم
👁 1
OpenAI تُعزز إجراءات الأمان بعد اختراق Hugging Face: كيف ستغير هذه الإجراءات مستقبل الذكاء الاصطناعي؟
أخلاقيات الذكاء الاصطناعي

OpenAI تُعزز إجراءات الأمان بعد اختراق Hugging Face: كيف ستغير هذه الإجراءات مستقبل الذكاء الاصطناعي؟

تيك كرانشمنذ 16 يوم
TwinGridShield: خطوة ثورية نحو الأمان في تشغيل النماذج اللغوية الكبيرة
أبحاث

TwinGridShield: خطوة ثورية نحو الأمان في تشغيل النماذج اللغوية الكبيرة

أركايف للذكاءمنذ 16 يوم
👁 3
PL-Guard: ثورة جديدة في أمان نماذج اللغات الكبيرة!
أبحاث

PL-Guard: ثورة جديدة في أمان نماذج اللغات الكبيرة!

أركايف للذكاءمنذ 16 يوم
👁 1
ستيرينغ سيفتي: رصد معايير الأمان في نماذج اللغات الكبيرة وتعزيز الأداء
أبحاث

ستيرينغ سيفتي: رصد معايير الأمان في نماذج اللغات الكبيرة وتعزيز الأداء

أركايف للذكاءمنذ 21 يوم
👁 2
الإبداع في الذكاء الاصطناعي: كيفية تركيز سلوك الرفض في نماذج اللغة الكبيرة!
أبحاث

الإبداع في الذكاء الاصطناعي: كيفية تركيز سلوك الرفض في نماذج اللغة الكبيرة!

أركايف للذكاءمنذ 21 يوم
👁 1
كيف تتحقق من اتساق التوقعات الاحتمالية؟ اكتشافات جديدة في أمان الذكاء الاصطناعي!
أبحاث

كيف تتحقق من اتساق التوقعات الاحتمالية؟ اكتشافات جديدة في أمان الذكاء الاصطناعي!

أركايف للذكاءمنذ 22 يوم
👁 1
SafeCap: ثورة في أمان نماذج الرؤية واللغة عبر التعلم المعزز!
أبحاث

SafeCap: ثورة في أمان نماذج الرؤية واللغة عبر التعلم المعزز!

أركايف للذكاءمنذ 22 يوم
👁 1
هل تعرف جميع نماذج اللغات الضخمة متى تكون ضارة؟ دراسة فريدة لفحص سلامة الفضاءات الكامنة!
أبحاث

هل تعرف جميع نماذج اللغات الضخمة متى تكون ضارة؟ دراسة فريدة لفحص سلامة الفضاءات الكامنة!

أركايف للذكاءمنذ 23 يوم
👁 2
حماية مستودع القيم: كيفية منع تسريبات المعلومات في أنظمة الذكاء الاصطناعي متعددة المستأجرين
أبحاث

حماية مستودع القيم: كيفية منع تسريبات المعلومات في أنظمة الذكاء الاصطناعي متعددة المستأجرين

أركايف للذكاءمنذ 23 يوم
👁 2