Ailoxa Logo

🏷️ #سلامة الذكاء الاصطناعي

91 مقال

SPQR: المعيار الثوري لتقييم سلامة نماذج تحويل النص إلى صورة!
أبحاث

SPQR: المعيار الثوري لتقييم سلامة نماذج تحويل النص إلى صورة!

أركايف للذكاءمنذ 1 شهر
إيجاد الشهادات الموضوعية للذكاء الاصطناعي: استكشاف جديد في قوة الشبكات العصبية المتعددة الطبقات
أبحاث

إيجاد الشهادات الموضوعية للذكاء الاصطناعي: استكشاف جديد في قوة الشبكات العصبية المتعددة الطبقات

أركايف للذكاءمنذ 1 شهر
👁 1
رحيل رئيس قسم المستقبل في OpenAI: ماذا يعني ذلك للذكاء الاصطناعي؟
أبحاث

رحيل رئيس قسم المستقبل في OpenAI: ماذا يعني ذلك للذكاء الاصطناعي؟

وايردمنذ 1 شهر
أوسترا-II: ثورة جديدة في تحقيق السلامة في نماذج اللغات الضخمة!
نماذج لغوية

أوسترا-II: ثورة جديدة في تحقيق السلامة في نماذج اللغات الضخمة!

أركايف للذكاءمنذ 1 شهر
👁 2
ابتكار جديد في مجال تعلم التعزيز: تقنية TraCeS لضمان السلامة في الذكاء الاصطناعي!
أبحاث

ابتكار جديد في مجال تعلم التعزيز: تقنية TraCeS لضمان السلامة في الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
👁 1
آثار تحليل الزوجي لتقنية الكم ودرجة حرارة العينات على سلامة نماذج اللغات الضخمة: دراسة مثيرة
أبحاث

آثار تحليل الزوجي لتقنية الكم ودرجة حرارة العينات على سلامة نماذج اللغات الضخمة: دراسة مثيرة

أركايف للذكاءمنذ 2 شهر
👁 1
هل يمكن تحقيق التوافق في الذكاء الاصطناعي العام؟ فهم الحدود الرياضية المعقدة!
أبحاث

هل يمكن تحقيق التوافق في الذكاء الاصطناعي العام؟ فهم الحدود الرياضية المعقدة!

أركايف للذكاءمنذ 2 شهر
👁 1
السلامة في الذكاء الاصطناعي: هل هي خاصية معرفية أم سلوكية؟
أبحاث

السلامة في الذكاء الاصطناعي: هل هي خاصية معرفية أم سلوكية؟

أركايف للذكاءمنذ 2 شهر
👁 1
تحكم بالأمان: تعزيز السلامة في نماذج الفيديو للذكاء الاصطناعي دون تدريب
أبحاث

تحكم بالأمان: تعزيز السلامة في نماذج الفيديو للذكاء الاصطناعي دون تدريب

أركايف للذكاءمنذ 2 شهر
تحديات التوافق في الذكاء الاصطناعي: هل تتكيف نظرية الإجماع الكلاسيكية مع الوكلاء ذات اللغة الضخمة؟
أبحاث

تحديات التوافق في الذكاء الاصطناعي: هل تتكيف نظرية الإجماع الكلاسيكية مع الوكلاء ذات اللغة الضخمة؟

أركايف للذكاءمنذ 2 شهر
كشف المستور: تقييم سلامة العملاء ضد هجمات التفكيك مع DECOMPBENCH
أبحاث

كشف المستور: تقييم سلامة العملاء ضد هجمات التفكيك مع DECOMPBENCH

أركايف للذكاءمنذ 2 شهر
مخاطر جديدة في تفاعلات متعددة: كيف نضمن أمان الوكلاء باستخدام الأدوات؟
أبحاث

مخاطر جديدة في تفاعلات متعددة: كيف نضمن أمان الوكلاء باستخدام الأدوات؟

أركايف للذكاءمنذ 2 شهر
فضيحة فصل مهندس في xAI يكشف عواقب سلامة الذكاء الاصطناعي قبل IPO تاريخي!
أخلاقيات الذكاء الاصطناعي

فضيحة فصل مهندس في xAI يكشف عواقب سلامة الذكاء الاصطناعي قبل IPO تاريخي!

تيك كرانشمنذ 2 شهر
👁 3
كيف تعزز SHAPO الأمان في تدريب الوكلاء الاصطناعيين؟ استكشاف مُحسّن لسياسات الذكاء الاصطناعي!
أبحاث

كيف تعزز SHAPO الأمان في تدريب الوكلاء الاصطناعيين؟ استكشاف مُحسّن لسياسات الذكاء الاصطناعي!

أركايف للذكاءمنذ 2 شهر
مواجهة السلامة والإبداع: استكشاف آليات المخاطر والاحتياطات في نماذج اللغات الشخصية!
أبحاث

مواجهة السلامة والإبداع: استكشاف آليات المخاطر والاحتياطات في نماذج اللغات الشخصية!

أركايف للذكاءمنذ 2 شهر
VESTA: إطار مبتكر لتوليد السيناريوهات وتقييم السلامة للوكالات الذكية
أبحاث

VESTA: إطار مبتكر لتوليد السيناريوهات وتقييم السلامة للوكالات الذكية

أركايف للذكاءمنذ 2 شهر
تحطيم قيود سلوك الآلات: الابتكار في تقييم الأنظمة متعددة الوكلاء
أبحاث

تحطيم قيود سلوك الآلات: الابتكار في تقييم الأنظمة متعددة الوكلاء

أركايف للذكاءمنذ 2 شهر
هل حان الوقت لإعادة التفكير في أبحاث عدم تطابق الإنسان الآلي؟ دعوة ملحة لتحسين الأدلة!
أبحاث

هل حان الوقت لإعادة التفكير في أبحاث عدم تطابق الإنسان الآلي؟ دعوة ملحة لتحسين الأدلة!

أركايف للذكاءمنذ 2 شهر
ثغرات الأمان السلوكي في نماذج الذكاء الاصطناعي: هل يكفي تقييم السلوك؟
أبحاث

ثغرات الأمان السلوكي في نماذج الذكاء الاصطناعي: هل يكفي تقييم السلوك؟

أركايف للذكاءمنذ 2 شهر
أسرار قيادة التفعيل: كيف تثير نماذج اللغة الكبيرة (LLMs) سلوكيات غير متوقعة؟
أبحاث

أسرار قيادة التفعيل: كيف تثير نماذج اللغة الكبيرة (LLMs) سلوكيات غير متوقعة؟

أركايف للذكاءمنذ 2 شهر