Ailoxa Logo

🏷️ #أمان

272 مقال

أحدث الابتكارات في أمان نماذج اللغة: دفاع استباقي ضد هجمات jailbreak
أبحاث

أحدث الابتكارات في أمان نماذج اللغة: دفاع استباقي ضد هجمات jailbreak

أركايف للذكاءمنذ 3 شهر
👁 1
Scam2Prompt: تطوير إطار عمل متقدم لتحليل المواقع الضارة في نماذج اللغات الضخمة
أبحاث

Scam2Prompt: تطوير إطار عمل متقدم لتحليل المواقع الضارة في نماذج اللغات الضخمة

أركايف للذكاءمنذ 3 شهر
إحداث ثورة في وكالات الذكاء الاصطناعي الطبية: أساليب مبتكرة لتعزيز الأمان والمصداقية!
أبحاث

إحداث ثورة في وكالات الذكاء الاصطناعي الطبية: أساليب مبتكرة لتعزيز الأمان والمصداقية!

أركايف للذكاءمنذ 3 شهر
👁 1
ثورة جديدة في الذكاء الاصطناعي: SB-TRPO يضمن التعلم المعزز بأمان تام!
أبحاث

ثورة جديدة في الذكاء الاصطناعي: SB-TRPO يضمن التعلم المعزز بأمان تام!

أركايف للذكاءمنذ 3 شهر
كيف يهدد الهجوم الجائر نماذج الذكاء الاصطناعي؟ تحليل شامل لاستراتيجيات كسر الحماية!
أبحاث

كيف يهدد الهجوم الجائر نماذج الذكاء الاصطناعي؟ تحليل شامل لاستراتيجيات كسر الحماية!

أركايف للذكاءمنذ 3 شهر
كيف تضمن OpenAI أمان تشغيل Codex؟ اكتشف تقنيات جديدة لتبني برمجي آمن!
أدوات

كيف تضمن OpenAI أمان تشغيل Codex؟ اكتشف تقنيات جديدة لتبني برمجي آمن!

مدونة أوبن إيه آيمنذ 4 شهر
تحدي تقييم أمان نماذج اللغة: كيف يمكن مقارنة النماذج بدون مؤشرات معيارية؟
أبحاث

تحدي تقييم أمان نماذج اللغة: كيف يمكن مقارنة النماذج بدون مؤشرات معيارية؟

أركايف للذكاءمنذ 4 شهر
👁 1
XL-SafetyBench: معيار محلي للتقييم الثقافي وحماية نماذج الذكاء الاصطناعي
أبحاث

XL-SafetyBench: معيار محلي للتقييم الثقافي وحماية نماذج الذكاء الاصطناعي

أركايف للذكاءمنذ 4 شهر
👁 1
اكتشاف المخاطر: PersonaTeaming تمهد الطريق لمستقبل أمان الذكاء الاصطناعي
أبحاث

اكتشاف المخاطر: PersonaTeaming تمهد الطريق لمستقبل أمان الذكاء الاصطناعي

أركايف للذكاءمنذ 4 شهر
هل تجهز أبحاثك للمخاطر الأمنية؟ اكتشافات مثيرة حول تقييم الأمان في المواد البحثية!
أبحاث

هل تجهز أبحاثك للمخاطر الأمنية؟ اكتشافات مثيرة حول تقييم الأمان في المواد البحثية!

أركايف للذكاءمنذ 4 شهر
أمان أكبر للوكالات الذكية: حل مبتكر لانتهاكات الخصوصية
أدوات

أمان أكبر للوكالات الذكية: حل مبتكر لانتهاكات الخصوصية

أركايف للذكاءمنذ 4 شهر
تقنية جديدة لزيادة أمان نماذج اللغة: كيف تم تقليل مخاطر الهجمات الضارة؟
أبحاث

تقنية جديدة لزيادة أمان نماذج اللغة: كيف تم تقليل مخاطر الهجمات الضارة؟

أركايف للذكاءمنذ 4 شهر
تعزيز أمان الأنظمة الذكية: تقنيات جديدة لتحسين الحكم في سيناريوهات الخداع
أبحاث

تعزيز أمان الأنظمة الذكية: تقنيات جديدة لتحسين الحكم في سيناريوهات الخداع

أركايف للذكاءمنذ 4 شهر
ضرورة السلامة قبل إطلاق أنظمة الذكاء الاصطناعي المفتوحة: تحديات وآفاق جديدة!
أخلاقيات الذكاء الاصطناعي

ضرورة السلامة قبل إطلاق أنظمة الذكاء الاصطناعي المفتوحة: تحديات وآفاق جديدة!

أركايف للذكاءمنذ 4 شهر
تحذير من مخاطر الذكاء الاصطناعي: الإدمان وفقدان المهارات في دائرة الضوء
أخلاقيات الذكاء الاصطناعي

تحذير من مخاطر الذكاء الاصطناعي: الإدمان وفقدان المهارات في دائرة الضوء

أركايف للذكاءمنذ 4 شهر
👁 11
MEMSAD: ابتكار ثوري في كشف التهديدات للذاكرة الخارجية لوكلاء الذكاء الاصطناعي
أبحاث

MEMSAD: ابتكار ثوري في كشف التهديدات للذاكرة الخارجية لوكلاء الذكاء الاصطناعي

أركايف للذكاءمنذ 4 شهر
إطلاق ميزة الاتصال الموثوق في ChatGPT: أمانك أولوية!
أخلاقيات الذكاء الاصطناعي

إطلاق ميزة الاتصال الموثوق في ChatGPT: أمانك أولوية!

مدونة أوبن إيه آيمنذ 4 شهر
تحليل العوامل: كيف تعزز تقنيات الدفاع المعتمدة على الذكاء الاصطناعي الأمان ضد الهجمات المتقدمة؟
أبحاث

تحليل العوامل: كيف تعزز تقنيات الدفاع المعتمدة على الذكاء الاصطناعي الأمان ضد الهجمات المتقدمة؟

أركايف للذكاءمنذ 4 شهر
حماية الذكاء الاصطناعي: طبقة كشف احتيال منخفضة الكمون لمواجهة التهديدات المتقدمة
أبحاث

حماية الذكاء الاصطناعي: طبقة كشف احتيال منخفضة الكمون لمواجهة التهديدات المتقدمة

أركايف للذكاءمنذ 4 شهر
فهم النجاح في اختراق نماذج اللغات الضخمة: الطريقة الثورية LOCA!
أبحاث

فهم النجاح في اختراق نماذج اللغات الضخمة: الطريقة الثورية LOCA!

أركايف للذكاءمنذ 4 شهر
👁 3