🏷️ #سلامة الذكاء الاصطناعي
91 مقال
أبحاث
SPQR: المعيار الثوري لتقييم سلامة نماذج تحويل النص إلى صورة!
أركايف للذكاءمنذ 1 شهر
أبحاث
إيجاد الشهادات الموضوعية للذكاء الاصطناعي: استكشاف جديد في قوة الشبكات العصبية المتعددة الطبقات
أركايف للذكاءمنذ 1 شهر
👁 1أبحاث
رحيل رئيس قسم المستقبل في OpenAI: ماذا يعني ذلك للذكاء الاصطناعي؟
وايردمنذ 1 شهر
نماذج لغوية
أوسترا-II: ثورة جديدة في تحقيق السلامة في نماذج اللغات الضخمة!
أركايف للذكاءمنذ 1 شهر
👁 2أبحاث
ابتكار جديد في مجال تعلم التعزيز: تقنية TraCeS لضمان السلامة في الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
آثار تحليل الزوجي لتقنية الكم ودرجة حرارة العينات على سلامة نماذج اللغات الضخمة: دراسة مثيرة
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
هل يمكن تحقيق التوافق في الذكاء الاصطناعي العام؟ فهم الحدود الرياضية المعقدة!
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
السلامة في الذكاء الاصطناعي: هل هي خاصية معرفية أم سلوكية؟
أركايف للذكاءمنذ 2 شهر
👁 1أبحاث
تحكم بالأمان: تعزيز السلامة في نماذج الفيديو للذكاء الاصطناعي دون تدريب
أركايف للذكاءمنذ 2 شهر
أبحاث
تحديات التوافق في الذكاء الاصطناعي: هل تتكيف نظرية الإجماع الكلاسيكية مع الوكلاء ذات اللغة الضخمة؟
أركايف للذكاءمنذ 2 شهر
أبحاث
كشف المستور: تقييم سلامة العملاء ضد هجمات التفكيك مع DECOMPBENCH
أركايف للذكاءمنذ 2 شهر
أبحاث
مخاطر جديدة في تفاعلات متعددة: كيف نضمن أمان الوكلاء باستخدام الأدوات؟
أركايف للذكاءمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
فضيحة فصل مهندس في xAI يكشف عواقب سلامة الذكاء الاصطناعي قبل IPO تاريخي!
تيك كرانشمنذ 2 شهر
👁 3أبحاث
كيف تعزز SHAPO الأمان في تدريب الوكلاء الاصطناعيين؟ استكشاف مُحسّن لسياسات الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
أبحاث
مواجهة السلامة والإبداع: استكشاف آليات المخاطر والاحتياطات في نماذج اللغات الشخصية!
أركايف للذكاءمنذ 2 شهر
أبحاث
VESTA: إطار مبتكر لتوليد السيناريوهات وتقييم السلامة للوكالات الذكية
أركايف للذكاءمنذ 2 شهر
أبحاث
تحطيم قيود سلوك الآلات: الابتكار في تقييم الأنظمة متعددة الوكلاء
أركايف للذكاءمنذ 2 شهر
أبحاث
هل حان الوقت لإعادة التفكير في أبحاث عدم تطابق الإنسان الآلي؟ دعوة ملحة لتحسين الأدلة!
أركايف للذكاءمنذ 2 شهر
أبحاث
ثغرات الأمان السلوكي في نماذج الذكاء الاصطناعي: هل يكفي تقييم السلوك؟
أركايف للذكاءمنذ 2 شهر
أبحاث
أسرار قيادة التفعيل: كيف تثير نماذج اللغة الكبيرة (LLMs) سلوكيات غير متوقعة؟
أركايف للذكاءمنذ 2 شهر
