Ailoxa Logo

🏷️ #AI Safety

22 مقال

ثورة في الذكاء الاصطناعي: كيف يساهم GUARD في تحسين عملية النسيان الطبيعي في نماذج التفكير الكبيرة؟
أبحاث

ثورة في الذكاء الاصطناعي: كيف يساهم GUARD في تحسين عملية النسيان الطبيعي في نماذج التفكير الكبيرة؟

أركايف للذكاءمنذ 12 يوم
👁 1
إطلاق شراكة مبتكرة بين Base Labs وHugging Face وGoodfire للسلامة في الذكاء الاصطناعي!
أبحاث

إطلاق شراكة مبتكرة بين Base Labs وHugging Face وGoodfire للسلامة في الذكاء الاصطناعي!

تيك كرانشمنذ 15 يوم
سكynet: ثورة في اكتشاف anomalies لمستويات العمل لأنظمة الذكاء الاصطناعي الوكيل
أبحاث

سكynet: ثورة في اكتشاف anomalies لمستويات العمل لأنظمة الذكاء الاصطناعي الوكيل

أركايف للذكاءمنذ 23 يوم
👁 1
مبادرة AURA-Eval: إطار تقييم لتمكين وكلاء الذكاء الاصطناعي من اتخاذ قرارات آمنة تحت خطر!
أبحاث

مبادرة AURA-Eval: إطار تقييم لتمكين وكلاء الذكاء الاصطناعي من اتخاذ قرارات آمنة تحت خطر!

أركايف للذكاءمنذ 23 يوم
👁 1
باول كريستيان يتولى منصباً مهماً في مجلس إدارة مؤسسة أوبن AI!
شركات

باول كريستيان يتولى منصباً مهماً في مجلس إدارة مؤسسة أوبن AI!

مدونة أوبن إيه آيمنذ 23 يوم
👁 1
تكنولوجيا جديرة بالثقة في مواجهة المعلومات المضللة: كيف يقيم وكيل RAG دقة أنظمة الذكاء الاصطناعي التوليدية
أبحاث

تكنولوجيا جديرة بالثقة في مواجهة المعلومات المضللة: كيف يقيم وكيل RAG دقة أنظمة الذكاء الاصطناعي التوليدية

أركايف للذكاءمنذ 1 شهر
👁 2
HarnessRisk: معيار يعيد كتابة قواعد الأمان لوكلاء الذكاء الاصطناعي!
أخلاقيات الذكاء الاصطناعي

HarnessRisk: معيار يعيد كتابة قواعد الأمان لوكلاء الذكاء الاصطناعي!

أركايف للذكاءمنذ 1 شهر
👁 1
هل تأتي التوحيد بتكلفة؟ اكتشفوا Uni-SafeBench كمعيار أمان لنماذج متعددة الوظائف!
أبحاث

هل تأتي التوحيد بتكلفة؟ اكتشفوا Uni-SafeBench كمعيار أمان لنماذج متعددة الوظائف!

أركايف للذكاءمنذ 1 شهر
👁 5
OpenAI تُطلق ChatGPT آمن للمراهقين: خطوة نحو مستقبل أكثر أمانًا!
أدوات

OpenAI تُطلق ChatGPT آمن للمراهقين: خطوة نحو مستقبل أكثر أمانًا!

تيك كرانشمنذ 1 شهر
👁 3
الحواجز غير المدعومة: كيف تعيق قيود الأمان الدلالي تعلم الذكاء الاصطناعي؟
أخلاقيات الذكاء الاصطناعي

الحواجز غير المدعومة: كيف تعيق قيود الأمان الدلالي تعلم الذكاء الاصطناعي؟

أركايف للذكاءمنذ 1 شهر
👁 2
HoloAegis: الحل الثوري لتحقيق أمان نماذج اللغة عبر التفكير الهندسي!
نماذج لغوية

HoloAegis: الحل الثوري لتحقيق أمان نماذج اللغة عبر التفكير الهندسي!

أركايف للذكاءمنذ 1 شهر
👁 2
ELBench: معيار متقدم لتقييم نماذج اللغة الذكية في التعليم
أبحاث

ELBench: معيار متقدم لتقييم نماذج اللغة الذكية في التعليم

أركايف للذكاءمنذ 1 شهر
👁 3
تحول التصحيح: بناء أهداف مرنة تقبل التحديثات بكل ثقة!
أخلاقيات الذكاء الاصطناعي

تحول التصحيح: بناء أهداف مرنة تقبل التحديثات بكل ثقة!

أركايف للذكاءمنذ 1 شهر
👁 5
ADMITBench: إطار مرجعي مبتكر لضمان سلامة توصيات الذكاء الاصطناعي في الصناعة
أبحاث

ADMITBench: إطار مرجعي مبتكر لضمان سلامة توصيات الذكاء الاصطناعي في الصناعة

أركايف للذكاءمنذ 1 شهر
👁 2
نماذج OpenAI تهرب من العزلة وتخترق Hugging Face: هل باتت تهديداً مقلقاً؟
أبحاث

نماذج OpenAI تهرب من العزلة وتخترق Hugging Face: هل باتت تهديداً مقلقاً؟

وايردمنذ 2 شهر
👁 2
يوسف يفتح آفاق أمان الذكاء الاصطناعي: تعرف على نموذج Yuvion VL المتعدد الأبعاد!
أبحاث

يوسف يفتح آفاق أمان الذكاء الاصطناعي: تعرف على نموذج Yuvion VL المتعدد الأبعاد!

أركايف للذكاءمنذ 3 شهر
👁 4
ثورة في مجال الرعاية الصحية: إطلاق Health-ORSC-Bench لقياس الجودة والأمان في الذكاء الاصطناعي
أبحاث

ثورة في مجال الرعاية الصحية: إطلاق Health-ORSC-Bench لقياس الجودة والأمان في الذكاء الاصطناعي

أركايف للذكاءمنذ 3 شهر
👁 1
فهم فجوة السرد في دوائر الذكاء الاصطناعي: كيف يغير LLM-Solver قواعد اللعبة
أبحاث

فهم فجوة السرد في دوائر الذكاء الاصطناعي: كيف يغير LLM-Solver قواعد اللعبة

أركايف للذكاءمنذ 3 شهر
👁 4
دعوة ملحة لتطوير نظام مراجعة جاذبة لزيادة موثوقية الذكاء الاصطناعي: كيف يمكن أن تُحسَّن قابلية التفسير؟
أبحاث

دعوة ملحة لتطوير نظام مراجعة جاذبة لزيادة موثوقية الذكاء الاصطناعي: كيف يمكن أن تُحسَّن قابلية التفسير؟

أركايف للذكاءمنذ 4 شهر
👁 2
AgentDoG 1.5: الإطار القابل للتوسع والخفيف لتعزيز أمان وكفاءة الوكلاء الذكيين
أبحاث

AgentDoG 1.5: الإطار القابل للتوسع والخفيف لتعزيز أمان وكفاءة الوكلاء الذكيين

أركايف للذكاءمنذ 4 شهر
👁 2