Ailoxa Logo

🏷️ #الأمان

165 مقال

دوال غيج: إطار مبتكر لتقييم الأمان والوظائف في توليد الكود بالاعتماد على نماذج اللغة العملاقة
أبحاث

دوال غيج: إطار مبتكر لتقييم الأمان والوظائف في توليد الكود بالاعتماد على نماذج اللغة العملاقة

أركايف للذكاءمنذ 2 شهر
👁 1
هل تعيش وكالات الذكاء الاصطناعي في عالم غير آمن؟ CmdNeedle يكشف حقيقة قوائم المنع الهشة!
أبحاث

هل تعيش وكالات الذكاء الاصطناعي في عالم غير آمن؟ CmdNeedle يكشف حقيقة قوائم المنع الهشة!

أركايف للذكاءمنذ 2 شهر
👁 1
هل تظل مراقبات السلامة موثوقة بعد التحديثات؟ اكتشفوا السرعة في مراقبة التنشيط!
أبحاث

هل تظل مراقبات السلامة موثوقة بعد التحديثات؟ اكتشفوا السرعة في مراقبة التنشيط!

أركايف للذكاءمنذ 2 شهر
هل قياسات تحرك مركبتك في بيئات طويلة الذيل آمنة؟ اكتشف الحلول الثورية!
أبحاث

هل قياسات تحرك مركبتك في بيئات طويلة الذيل آمنة؟ اكتشف الحلول الثورية!

أركايف للذكاءمنذ 2 شهر
👁 2
CSPO: كيف تعزز سياسة التعلم المعزز الآمن من خلال تحسين قيود السلامة؟
أبحاث

CSPO: كيف تعزز سياسة التعلم المعزز الآمن من خلال تحسين قيود السلامة؟

أركايف للذكاءمنذ 2 شهر
👁 1
كيف تفشل الأنظمة الذكية في تحقيق متطلبات السلامة العامة: دراسة تعرض عيوب الأطر المعتمدة
أخلاقيات الذكاء الاصطناعي

كيف تفشل الأنظمة الذكية في تحقيق متطلبات السلامة العامة: دراسة تعرض عيوب الأطر المعتمدة

أركايف للذكاءمنذ 2 شهر
ALIGNBEAM: ابتكار ثوري ينقل الأمان بين النماذج اللغوية في وقت الاستدلال
أبحاث

ALIGNBEAM: ابتكار ثوري ينقل الأمان بين النماذج اللغوية في وقت الاستدلال

أركايف للذكاءمنذ 2 شهر
ثورة الأمان في البرمجة: MPC-Patch-Bench ونموذج LLM المبتكر لحماية الحسابات متعددة الأطراف!
أبحاث

ثورة الأمان في البرمجة: MPC-Patch-Bench ونموذج LLM المبتكر لحماية الحسابات متعددة الأطراف!

أركايف للذكاءمنذ 2 شهر
تحديات تذكر المعلومات في نماذج الذكاء الاصطناعي: كيف تؤثر خيارات التصميم على الخصوصية والفائدة؟
أبحاث

تحديات تذكر المعلومات في نماذج الذكاء الاصطناعي: كيف تؤثر خيارات التصميم على الخصوصية والفائدة؟

أركايف للذكاءمنذ 2 شهر
ثغرات هروب ملحوظة: الكشف عن نقاط ضعف نماذج اللغة المتعددة اللغات في الذكاء الاصطناعي
أبحاث

ثغرات هروب ملحوظة: الكشف عن نقاط ضعف نماذج اللغة المتعددة اللغات في الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة في البنية التحتية للذكاء الاصطناعي: ضمان توافق دلالي يضمن الأمان عبر الشبكات!
أبحاث

ثورة في البنية التحتية للذكاء الاصطناعي: ضمان توافق دلالي يضمن الأمان عبر الشبكات!

أركايف للذكاءمنذ 2 شهر
كشف النقاب عن VisualLeakBench: كيف تتعرض النماذج اللغوية للتهديدات في معالجة الصورة والنص؟
أبحاث

كشف النقاب عن VisualLeakBench: كيف تتعرض النماذج اللغوية للتهديدات في معالجة الصورة والنص؟

أركايف للذكاءمنذ 2 شهر
تحديات الرقابة على وكالات الذكاء الاصطناعي: كيف يمكن تحسين أمان القرارات البشرية؟
أبحاث

تحديات الرقابة على وكالات الذكاء الاصطناعي: كيف يمكن تحسين أمان القرارات البشرية؟

أركايف للذكاءمنذ 2 شهر
👁 2
مشكلة الإيقاف القاتل: تحديات الذكاء الاصطناعي وسبل الأمان
أخلاقيات الذكاء الاصطناعي

مشكلة الإيقاف القاتل: تحديات الذكاء الاصطناعي وسبل الأمان

أركايف للذكاءمنذ 2 شهر
فكر سريعاً: تقدير أوقات إنجاز المهام للذكاء الاصطناعي المتطور بدون تفكير صريح!
أبحاث

فكر سريعاً: تقدير أوقات إنجاز المهام للذكاء الاصطناعي المتطور بدون تفكير صريح!

أركايف للذكاءمنذ 2 شهر
استراتيجيات هجوم الذكاء الاصطناعي: كيف تؤثر اختيارات المهاجمين على السلامة؟
أخلاقيات الذكاء الاصطناعي

استراتيجيات هجوم الذكاء الاصطناعي: كيف تؤثر اختيارات المهاجمين على السلامة؟

أركايف للذكاءمنذ 2 شهر
رؤية مستقبلية مثيرة للذكاء الاصطناعي: كيف نضمن النجاح للجميع؟
أبحاث

رؤية مستقبلية مثيرة للذكاء الاصطناعي: كيف نضمن النجاح للجميع؟

مدونة أوبن إيه آيمنذ 2 شهر
انكشاف خلل وصف الشفرة في خوادم بروتوكول نموذج السياق: دراسة شاملة لأبعاده الأمنية
أبحاث

انكشاف خلل وصف الشفرة في خوادم بروتوكول نموذج السياق: دراسة شاملة لأبعاده الأمنية

أركايف للذكاءمنذ 3 شهر
👁 1
عالم جديد من الأمان والموثوقية: Agents LLM القابلة للتدقيق بواسطة الإنسان!
أبحاث

عالم جديد من الأمان والموثوقية: Agents LLM القابلة للتدقيق بواسطة الإنسان!

أركايف للذكاءمنذ 3 شهر
👁 1
SafeSteer: تحسين سلامة نماذج الذكاء الاصطناعي بكفاءة مذهلة!
أبحاث

SafeSteer: تحسين سلامة نماذج الذكاء الاصطناعي بكفاءة مذهلة!

أركايف للذكاءمنذ 3 شهر
👁 2