Ailoxa Logo

🏷️ #أمان

272 مقال

تحقيق الأمان في نماذج اللغات الضخمة: تحسين القدرة على التعزيز عبر تقنيات جديدة!
أبحاث

تحقيق الأمان في نماذج اللغات الضخمة: تحسين القدرة على التعزيز عبر تقنيات جديدة!

أركايف للذكاءمنذ 3 شهر
ثورة في أمان نماذج الذكاء الاصطناعي: اكتشاف ميزات الرفض using CRaFT!
أبحاث

ثورة في أمان نماذج الذكاء الاصطناعي: اكتشاف ميزات الرفض using CRaFT!

أركايف للذكاءمنذ 3 شهر
SkillSieve: إطار مبتكر لرصد مهارات وكلاء الذكاء الصناعي الضارة
أبحاث

SkillSieve: إطار مبتكر لرصد مهارات وكلاء الذكاء الصناعي الضارة

أركايف للذكاءمنذ 3 شهر
👁 1
فجوة المراقبة والتحكم: لماذا لا تكفي نماذج الذكاء الاصطناعي لاستجابة فعالة
أبحاث

فجوة المراقبة والتحكم: لماذا لا تكفي نماذج الذكاء الاصطناعي لاستجابة فعالة

أركايف للذكاءمنذ 3 شهر
اختراق سلسلة التفكير: كيف يمكن لنماذج التفكير المطولة أن تفقد قدرتها على الرفض؟
أخلاقيات الذكاء الاصطناعي

اختراق سلسلة التفكير: كيف يمكن لنماذج التفكير المطولة أن تفقد قدرتها على الرفض؟

أركايف للذكاءمنذ 3 شهر
تحديد عدم اليقين في نماذج اللغات الضخمة: الابتكار الذي سيحدث ثورة في الأمان!
أبحاث

تحديد عدم اليقين في نماذج اللغات الضخمة: الابتكار الذي سيحدث ثورة في الأمان!

أركايف للذكاءمنذ 3 شهر
تكنولوجيا جديدة تُحدث ثورة في أمان الحوار مع نماذج اللغات الضخمة: تعرف على SafeCtrl-RL!
أبحاث

تكنولوجيا جديدة تُحدث ثورة في أمان الحوار مع نماذج اللغات الضخمة: تعرف على SafeCtrl-RL!

أركايف للذكاءمنذ 3 شهر
استكشف KYA: الطبقة الثقة المستقلة للأنظمة الذاتية الموثوقة!
أبحاث

استكشف KYA: الطبقة الثقة المستقلة للأنظمة الذاتية الموثوقة!

أركايف للذكاءمنذ 3 شهر
تحصينات الذكاء الاصطناعي: كيف نحمي نماذج اللغة الضخمة من التهديدات المتطورة؟
أبحاث

تحصينات الذكاء الاصطناعي: كيف نحمي نماذج اللغة الضخمة من التهديدات المتطورة؟

أركايف للذكاءمنذ 3 شهر
تجديد التفكير في الذكاء الاصطناعي: إعادة المحاولة مقابل إعادة العينة
أبحاث

تجديد التفكير في الذكاء الاصطناعي: إعادة المحاولة مقابل إعادة العينة

أركايف للذكاءمنذ 3 شهر
التحليل الأمني لتوجيه نماذج Mixtral MoE: هل تسهم الزناديات في سلامة الذكاء الاصطناعي؟
أبحاث

التحليل الأمني لتوجيه نماذج Mixtral MoE: هل تسهم الزناديات في سلامة الذكاء الاصطناعي؟

أركايف للذكاءمنذ 3 شهر
Palette: الإطار المتكامل لضبط أمان نماذج الذكاء الاصطناعي بخطوات مرنة وفعالة!
أبحاث

Palette: الإطار المتكامل لضبط أمان نماذج الذكاء الاصطناعي بخطوات مرنة وفعالة!

أركايف للذكاءمنذ 3 شهر
كيف تعزز الذكاء الاصطناعي الأمان في إدارة مرض السكري؟ اكتشافات مثيرة في التعلم المعزز الآمن!
أبحاث

كيف تعزز الذكاء الاصطناعي الأمان في إدارة مرض السكري؟ اكتشافات مثيرة في التعلم المعزز الآمن!

أركايف للذكاءمنذ 3 شهر
👁 1
MCPXKIT: أداة شاملة لتحليل أمان بروتوكولات نماذج السياق
أبحاث

MCPXKIT: أداة شاملة لتحليل أمان بروتوكولات نماذج السياق

أركايف للذكاءمنذ 3 شهر
هجوم GradingAttack: كشف ثغرات الأمان في وكلاء التقييم التعليمي المعتمدين على نماذج اللغة العملاقة
أبحاث

هجوم GradingAttack: كشف ثغرات الأمان في وكلاء التقييم التعليمي المعتمدين على نماذج اللغة العملاقة

أركايف للذكاءمنذ 3 شهر
تحقيق أمان موثوق في نماذج اللغة الكبيرة: كيف يمكننا تحقيق توازن بين السلوك الآمن ونوايا المستخدم؟
أبحاث

تحقيق أمان موثوق في نماذج اللغة الكبيرة: كيف يمكننا تحقيق توازن بين السلوك الآمن ونوايا المستخدم؟

أركايف للذكاءمنذ 3 شهر
👁 1
تحذير من استخدام الذكاء الاصطناعي في إزالة قناع الوجه: خطر التفريط في الهوية!
أخلاقيات الذكاء الاصطناعي

تحذير من استخدام الذكاء الاصطناعي في إزالة قناع الوجه: خطر التفريط في الهوية!

أركايف للذكاءمنذ 3 شهر
هل تهدد تقنيات الذكاء الاصطناعي جودة وأمان البرمجيات؟ دراسة جديدة عن إعادة هيكلة الكود بلغة بايثون
أبحاث

هل تهدد تقنيات الذكاء الاصطناعي جودة وأمان البرمجيات؟ دراسة جديدة عن إعادة هيكلة الكود بلغة بايثون

أركايف للذكاءمنذ 3 شهر
التحكم الذاتي في عملاء الذكاء الاصطناعي: أحدث الابتكارات في الحوكمة من أجل الأداء المستدام!
أخلاقيات الذكاء الاصطناعي

التحكم الذاتي في عملاء الذكاء الاصطناعي: أحدث الابتكارات في الحوكمة من أجل الأداء المستدام!

أركايف للذكاءمنذ 3 شهر
👁 2
هارمونيك أتاك: تقنية مبتكرة لإزالة العلامات المائية من الصوتيات المستندة للذكاء الاصطناعي
أبحاث

هارمونيك أتاك: تقنية مبتكرة لإزالة العلامات المائية من الصوتيات المستندة للذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر