Ailoxa Logo

🏷️ #سلامة الذكاء الاصطناعي

91 مقال

هل يمكن لنماذج اللغات الكبيرة التحكم في تمثيلاتها الداخلية؟ دراسة جديدة تكشف الحقيقة!
أبحاث

هل يمكن لنماذج اللغات الكبيرة التحكم في تمثيلاتها الداخلية؟ دراسة جديدة تكشف الحقيقة!

أركايف للذكاءمنذ 2 يوم
👁 1
TRACE: المعيار الثوري لتقييم سلامة نماذج التفكير الكبيرة!
أبحاث

TRACE: المعيار الثوري لتقييم سلامة نماذج التفكير الكبيرة!

أركايف للذكاءمنذ 9 يوم
👁 1
EviSafe: الابتكار في تقييم سلامة نماذج الرؤية واللغة
أبحاث

EviSafe: الابتكار في تقييم سلامة نماذج الرؤية واللغة

أركايف للذكاءمنذ 10 يوم
👁 1
أوبن AI تدعو لتعزيز قانون سلامة الذكاء الاصطناعي في كاليفورنيا!
أخلاقيات الذكاء الاصطناعي

أوبن AI تدعو لتعزيز قانون سلامة الذكاء الاصطناعي في كاليفورنيا!

تيك كرانشمنذ 12 يوم
👁 2
فجوة السلامة في نماذج اللغات الضخمة: استعراض شامل للغات ذات الموارد المحدودة
أبحاث

فجوة السلامة في نماذج اللغات الضخمة: استعراض شامل للغات ذات الموارد المحدودة

أركايف للذكاءمنذ 17 يوم
CUBICS: الابتكار الثوري في تقدير أداء مكونات الذكاء الاصطناعي في بيئات السلامة
أبحاث

CUBICS: الابتكار الثوري في تقدير أداء مكونات الذكاء الاصطناعي في بيئات السلامة

أركايف للذكاءمنذ 17 يوم
👁 2
هل نستند إلى القواعد أم إلى الشخصية؟ كيف يؤثر تصميم سلامة الذكاء الاصطناعي مع زيادة حجم الانتشار!
أبحاث

هل نستند إلى القواعد أم إلى الشخصية؟ كيف يؤثر تصميم سلامة الذكاء الاصطناعي مع زيادة حجم الانتشار!

أركايف للذكاءمنذ 21 يوم
👁 1
سلامة الوكلاء: ضرورة وجود عقد وقت التشغيل لضمان الأمان في الذكاء الاصطناعي
أبحاث

سلامة الوكلاء: ضرورة وجود عقد وقت التشغيل لضمان الأمان في الذكاء الاصطناعي

أركايف للذكاءمنذ 22 يوم
سلامة الذكاء الاصطناعي: تصميم مؤسساتي يُعيد تشكيل الأنظمة الذكية!
أبحاث

سلامة الذكاء الاصطناعي: تصميم مؤسساتي يُعيد تشكيل الأنظمة الذكية!

أركايف للذكاءمنذ 24 يوم
👁 1
مؤشر InfoOps: مقياس سلامة عمليات المعلومات باستخدام الذكاء الاصطناعي
أبحاث

مؤشر InfoOps: مقياس سلامة عمليات المعلومات باستخدام الذكاء الاصطناعي

أركايف للذكاءمنذ 24 يوم
👁 2
ثغرات السلامة: كيف تعاني نماذج الذكاء الاصطناعي متعددة اللغات من مشكلات رفض الطلبات الضارة
أبحاث

ثغرات السلامة: كيف تعاني نماذج الذكاء الاصطناعي متعددة اللغات من مشكلات رفض الطلبات الضارة

أركايف للذكاءمنذ 24 يوم
👁 1
ثورة الحماية الذكية: آليات تطور حزام الأمان لوكلاء نماذج اللغات الضخمة!
أبحاث

ثورة الحماية الذكية: آليات تطور حزام الأمان لوكلاء نماذج اللغات الضخمة!

أركايف للذكاءمنذ 24 يوم
أوبن أيه آي تضيف قيود السلامة على أسترا: كيف سيؤثر ذلك على مستقبل الذكاء الاصطناعي؟
أبحاث

أوبن أيه آي تضيف قيود السلامة على أسترا: كيف سيؤثر ذلك على مستقبل الذكاء الاصطناعي؟

الرائد في أخبار الذكاءمنذ 25 يوم
ما تخفيه معايير الذكاء الاصطناعي الحالية: الفجوات في القياسات وتداعياتها على التقييمات الأمنية!
أبحاث

ما تخفيه معايير الذكاء الاصطناعي الحالية: الفجوات في القياسات وتداعياتها على التقييمات الأمنية!

أركايف للذكاءمنذ 28 يوم
ابتكار نظام الأمان الذاتي: هل يمكن للنماذج الذكية تنظيمها بشكل أفضل؟
أبحاث

ابتكار نظام الأمان الذاتي: هل يمكن للنماذج الذكية تنظيمها بشكل أفضل؟

أركايف للذكاءمنذ 1 شهر
👁 3
كشف المخاطر الجسيمة: كيف تؤثر مواصفات الأدوات على سلامة عملاء الذكاء الاصطناعي؟
أبحاث

كشف المخاطر الجسيمة: كيف تؤثر مواصفات الأدوات على سلامة عملاء الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
رحيل مؤسس آلية التفكير ليليان ونج عن الشركة وانضمامها إلى OpenAI: ماذا يعني هذا للذكاء الاصطناعي؟
أخلاقيات الذكاء الاصطناعي

رحيل مؤسس آلية التفكير ليليان ونج عن الشركة وانضمامها إلى OpenAI: ماذا يعني هذا للذكاء الاصطناعي؟

تيك كرانشمنذ 1 شهر
أبعاد جديدة لسلامة الذكاء الاصطناعي: كيف نحقق التوافق مع الأخلاقيات؟
أخلاقيات الذكاء الاصطناعي

أبعاد جديدة لسلامة الذكاء الاصطناعي: كيف نحقق التوافق مع الأخلاقيات؟

أركايف للذكاءمنذ 1 شهر
مواجهة الخطر: كيف يُظهر الذكاء الاصطناعي قدرة مُفاجئة في التعامل مع الأهداف الحساسة؟
أبحاث

مواجهة الخطر: كيف يُظهر الذكاء الاصطناعي قدرة مُفاجئة في التعامل مع الأهداف الحساسة؟

أركايف للذكاءمنذ 1 شهر
👁 2
اختراق جديد في الذكاء الاصطناعي: نظام GPT-Red لتحقيق التحسين الذاتي والأمان المتين!
أبحاث

اختراق جديد في الذكاء الاصطناعي: نظام GPT-Red لتحقيق التحسين الذاتي والأمان المتين!

مدونة أوبن إيه آيمنذ 1 شهر
👁 2