تتسارع تطورات الهجمات الدفاعية والهجومية على نماذج اللغة الكبيرة (Large Language Models) بشكل كبير. ومع ذلك، كانت الفرق التي تقوم بهذه الهجمات والدفاعات تعمل في عزلة، مما يصعب الثقة في النتائج المستخلصة.

للتغلب على هذه العقبة، تم تقديم ACEA (ساحة التنازع لتطور الخصوم)، منصة متطورة تربط بين محولات الهجوم (red-team adapter) ومحولات الدفاع (blue-team adapter). تتميز ACEA بعدة مكونات رئيسية.

أولاً، هي ساحة قابلة للتوصيل، لا تتعلق بنموذج معين، حيث يمكن لأي مشروع من مشاريع الأحمر أو الأزرق الاتصال عبر بروتوكول HTTP مبسط يُسمى بروتوكول محول ACEA القياسي (ASAP). يمكن كتابة هذا البروتوكول بأي لغة، مما يجعل أي مشروع يتبعه شريكًا فعّالًا.

ثانيًا، طورت ACEA منهجية تقييم خاصة للجولات العدائية. من خلال زرع أسرار شائعة في الهدف، يمكن الحصول على حقائق موثوقة تفصل بين التسريبات الحقيقية والتخيلات. تُرسل جميع الهجمات إلى الهدف حتى عندما تعيق الدفاعات، مما يقيس قوة الهجوم بشكل مستقل.

ثالثاً، تتمتع ACEA بتصور لم يظهر سابقاً حيث توفر تقارير تفصيلية بنهاية كل جولة، مما يعزز تجربة المستخدم بوضوح عن مكان الفشل.

رابعاً، توفّر ACEA حلقة تحسين اختيارية في السياق، تزيد من فعالية كل جولة عبر تقديم نصائح للأدوات المستقبلية.

يمكن للمحولات التكيف عبر الجولات دون الاحتفاظ بحالة إذا ما قارأت النصائح. تم تصميم ACEA لتكون منصة متكاملة وفعالة، تتيح للفرق الحمراء والزرقاء اختبار إمكانياتها على نحو ديناميكي ومحسّن.