في عالم الذكاء الاصطناعي المتنامي، يعتمد الذكاء الاصطناعي الفاعل (Agentic AI) على أدوات قادرة على إجراء تغييرات حقيقية في الأنظمة، مثل تعديل الملفات وإرسال الرسائل. ولكن مع هذه الإمكانيات الجديدة تأتي تحديات كبيرة فيما يتعلق بالسلامة والأخلاقيات.

لذلك، تم تقديم أجياس (Aegis) كنظام متقدم لإدارة هذا النوع من الذكاء الاصطناعي. يعمل أجياس على تحويل نواتج النموذج إلى مقترحات فعّالة، وينظمها عبر طبقة قرار موثوقة قبل تنفيذ أي أداة. الفكرة هي أن النموذج يقترح، بينما يتخذ النظام الموثوق القرار.

خلال تقييم أجياس، تم استخدام خمسة عائلات من المهام تمت ملاحظتها عبر 42 مهمة وأكثر من 6,300 صف. ورغم الكشف عن 79 حالة تسرب خطير في حالة واحدة، فإن أجياس عمل بشكل فعال على منع أي تطبيقات أو تأثيرات جانبية غير مرغوبة. حيث لم تسجل أي حالة تأثير جانبي خطر تحت إدارة هذا النظام.

هكذا، فإن أجياس لا يثبت فقط أمان الأنظمة الذاتية بشكل عام، بل يبرز أيضاً فعالية فكرة إدارة الحدود الزمنية للإجراءات للحد من المقترحات الخطرة من التحول إلى تأثيرات سلبية. إن نتائج هذا النظام توفر آمال جديدة لضمان استخدام آمن وموثوق للذكاء الاصطناعي، مما يعكس أهمية التطبيقات الآمنة لهذه التقنيات.