🏷️ #سلامة الذكاء الاصطناعي
72 مقال
أبحاث
هل تتفوق نماذج اللغة المتعددة الأنماط في الأمان؟ اكتشافات جديدة حول انهيار هندسة الأمان
أركايف للذكاءمنذ 2 شهر
أبحاث
التذكر بشكل أفضل، مع مخاطر أكبر: التحديات الأمنية لوكلاء الذكاء الاصطناعي المجهزين بالذاكرة
أركايف للذكاءمنذ 2 شهر
أبحاث
تحديات ومعايير: ماذا تعرف عن سلامة نماذج اللغات الضخمة (LLM)؟
أركايف للذكاءمنذ 2 شهر
أبحاث
ضمان سلامة الذكاء الاصطناعي: هل يمكن السيطرة على المخاطر الخارجية؟
أركايف للذكاءمنذ 2 شهر
أبحاث
ATBench: منصة جديدة لقياس سلامة وكفاءة الوكلاء الذكيين!
أركايف للذكاءمنذ 2 شهر
أبحاث
نموذج التفريغ الآمن: ثورة في التحكم بالسلامة في نماذج النصوص
أركايف للذكاءمنذ 2 شهر
نماذج لغوية
اكتشاف ThinkSafe: الابتكار الثوري في تحسين سلامة نماذج التفكير!
أركايف للذكاءمنذ 2 شهر
أبحاث
فهم سياسة سلامة المعلّقين: كيف تجعل التعلم الآلي أكثر أماناً وشفافية
أركايف للذكاءمنذ 2 شهر
أبحاث
الدفاع الذكي: كيف يحمي نموذج الذكاء الاصطناعي نفسه من التعديلات الضارة؟
أركايف للذكاءمنذ 2 شهر
أبحاث
سلامة الذكاء الاصطناعي المتجسد: استكشاف المخاطر والتحديات الأمنية
أركايف للذكاءمنذ 2 شهر
أبحاث
تحقيق التوازن المثالي: ابتكار LLM-VA للتغلب على تحديات الذكاء الاصطناعي!
أركايف للذكاءمنذ 2 شهر
أخلاقيات الذكاء الاصطناعي
تحكم الذكاء الاصطناعي: إطار عمل جديد لفهم الحدود والسيطرة غير القابلة للعكس!
أركايف للذكاءمنذ 2 شهر
أبحاث
نماذج التفكير الكبيرة: الرؤية الآمنة من خلال تعزيز اتخاذ قرارات السلامة
أركايف للذكاءمنذ 2 شهر
أبحاث
REFUSALGUARD: كيفية تعزيز أمان نماذج الذكاء الاصطناعي دون التأثير على أدائها
أركايف للذكاءمنذ 2 شهر
أبحاث
كشف الأسرار: تقييم سلامة 20 نموذجاً لغوياً ضخماً بطريقة مبتكرة!
أركايف للذكاءمنذ 2 شهر
👁 1أخلاقيات الذكاء الاصطناعي
كيف تضمن الشركات الكبرى سلامة نماذج الذكاء الاصطناعي؟ تعرف على تقارير المخاطر الداخلية!
أركايف للذكاءمنذ 2 شهر
روبوتات
تقييم سلامة نماذج اللغة الكبيرة في التحكم بالروبوتات الصحية: نتائج مثيرة!
أركايف للذكاءمنذ 2 شهر
أبحاث
هل تهدد نماذج الذكاء الاصطناعي سلامة أبحاث الذكاء الاصطناعي؟
أركايف للذكاءمنذ 2 شهر
أبحاث
اكتشاف معايير السلامة الوكيلة من إشارات الخطر الأحادية: كيف تؤسس نماذج الذكاء الاصطناعي قواعد سلوك آمنة؟
أركايف للذكاءمنذ 2 شهر
أبحاث
مخاطر خفية: اكتشاف التحديات الجديدة لنماذج اللغات الضخمة
أركايف للذكاءمنذ 2 شهر
