Ailoxa Logo

🏷️ #أمان الذكاء الاصطناعي

115 مقال

تحسين أمان النماذج اللغوية: اكتشاف AnchorKV في ضغط ذاكرة التخزين المؤقت
أبحاث

تحسين أمان النماذج اللغوية: اكتشاف AnchorKV في ضغط ذاكرة التخزين المؤقت

أركايف للذكاءمنذ 1 شهر
مواجهة هجمات حقن التعليمات الذكية: تقنية جديدة لتعزيز الأمان في أنظمة الذكاء الاصطناعي
أبحاث

مواجهة هجمات حقن التعليمات الذكية: تقنية جديدة لتعزيز الأمان في أنظمة الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
ثورة في أمان الذكاء الاصطناعي: كيف تعزز نماذج التفكير الكبيرة الوعي بالسلامة الخفية؟
أبحاث

ثورة في أمان الذكاء الاصطناعي: كيف تعزز نماذج التفكير الكبيرة الوعي بالسلامة الخفية؟

أركايف للذكاءمنذ 1 شهر
ثورة الأمان في الذكاء الاصطناعي: اكتشاف الثغرات باستخدام DeepTrap!
أبحاث

ثورة الأمان في الذكاء الاصطناعي: اكتشاف الثغرات باستخدام DeepTrap!

أركايف للذكاءمنذ 1 شهر
إنقاذ النماذج: تقنية InstantForget تضمن أماناً أفضل دون الحاجة لتحديثات!
أبحاث

إنقاذ النماذج: تقنية InstantForget تضمن أماناً أفضل دون الحاجة لتحديثات!

أركايف للذكاءمنذ 1 شهر
تحديات جديدة في أمان الذكاء الاصطناعي: كيف تتلاعب وكالات نماذج اللغة بالمكافآت؟
أبحاث

تحديات جديدة في أمان الذكاء الاصطناعي: كيف تتلاعب وكالات نماذج اللغة بالمكافآت؟

أركايف للذكاءمنذ 1 شهر
تحذيرات Anthropic انقلبت ضدها: الحكومة تُوقف أقوى نماذج الذكاء الاصطناعي!
أبحاث

تحذيرات Anthropic انقلبت ضدها: الحكومة تُوقف أقوى نماذج الذكاء الاصطناعي!

تيك كرانشمنذ 1 شهر
👁 2
تعلم التعزيز: ثورة في مواجهة هجمات الذكاء الاصطناعي المعادية!
أبحاث

تعلم التعزيز: ثورة في مواجهة هجمات الذكاء الاصطناعي المعادية!

أركايف للذكاءمنذ 1 شهر
جديد الذكاء الاصطناعي: أداة JailbreakOPT لتحسين الهجمات المعقدة على نماذج اللغة
أبحاث

جديد الذكاء الاصطناعي: أداة JailbreakOPT لتحسين الهجمات المعقدة على نماذج اللغة

أركايف للذكاءمنذ 1 شهر
ثورة جديدة في عالم الذكاء الاصطناعي: تعلم حقن الأوامر بطريقة تلقائية مع AutoInject!
أبحاث

ثورة جديدة في عالم الذكاء الاصطناعي: تعلم حقن الأوامر بطريقة تلقائية مع AutoInject!

أركايف للذكاءمنذ 1 شهر
تحسين أمان نماذج اللغات الضخمة: كيف تسهم تقنية DualSelect في الحفاظ على السلوك الآمن عند التخصيص!
أبحاث

تحسين أمان نماذج اللغات الضخمة: كيف تسهم تقنية DualSelect في الحفاظ على السلوك الآمن عند التخصيص!

أركايف للذكاءمنذ 1 شهر
PLAGUE: إطار مبتكر لمواجهة التهديدات المستمرة في الحوار مع نماذج الذكاء الاصطناعي
أبحاث

PLAGUE: إطار مبتكر لمواجهة التهديدات المستمرة في الحوار مع نماذج الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
تعرف على حُدود الأمان في بيئات الذكاء الاصطناعي: دراسة مقارنة مُثيرة للجدل
أبحاث

تعرف على حُدود الأمان في بيئات الذكاء الاصطناعي: دراسة مقارنة مُثيرة للجدل

أركايف للذكاءمنذ 1 شهر
هجمات التفكيك المتقطع: كيف تستغل الثغرات في أدوات نماذج اللغات الضخمة؟
أبحاث

هجمات التفكيك المتقطع: كيف تستغل الثغرات في أدوات نماذج اللغات الضخمة؟

أركايف للذكاءمنذ 1 شهر
أسود الهجاء في عالم الذكاء الاصطناعي: كيف تحمي عملاء الكمبيوتر من الهجمات الخبيثة؟
أخلاقيات الذكاء الاصطناعي

أسود الهجاء في عالم الذكاء الاصطناعي: كيف تحمي عملاء الكمبيوتر من الهجمات الخبيثة؟

أركايف للذكاءمنذ 1 شهر
POIROT: ثورة في نظام التفاعل بين الوكلاء للكشف عن الأخطاء في أنظمة متعددة الوكلاء!
أدوات

POIROT: ثورة في نظام التفاعل بين الوكلاء للكشف عن الأخطاء في أنظمة متعددة الوكلاء!

أركايف للذكاءمنذ 1 شهر
👁 2
مقاربة جديدة لفهم الانحرافات الشائعة في نماذج الذكاء الاصطناعي: دراسة متعددة النماذج!
أبحاث

مقاربة جديدة لفهم الانحرافات الشائعة في نماذج الذكاء الاصطناعي: دراسة متعددة النماذج!

أركايف للذكاءمنذ 1 شهر
👁 2
هجوم التعليمات على نماذج اللغة: كيف تتغير نتائج الضعف حسب السطح؟
أبحاث

هجوم التعليمات على نماذج اللغة: كيف تتغير نتائج الضعف حسب السطح؟

أركايف للذكاءمنذ 1 شهر
👁 1
ثورة في أمان تحويل النص إلى صورة: كيف يضمن SafeDIG سلامة النتائج!
أبحاث

ثورة في أمان تحويل النص إلى صورة: كيف يضمن SafeDIG سلامة النتائج!

أركايف للذكاءمنذ 1 شهر
الأهمية كضعف: كيف يؤدي استرجاع المعلومات من الويب إلى تدهور الأمان في وكلاء النماذج اللغوية الضخمة؟
أبحاث

الأهمية كضعف: كيف يؤدي استرجاع المعلومات من الويب إلى تدهور الأمان في وكلاء النماذج اللغوية الضخمة؟

أركايف للذكاءمنذ 1 شهر