في عالم الذكاء الاصطناعي المتصاعد، تتجه الأنظار إلى الأنظمة الذاتية التطور (Self-Evolving Skill Systems) وكيفية استغلالها لتوليد مهارات موثوقة من تجارب غير موثوقة. وتستند هذه الأنظمة على مبدأ مهم: تحويل تجارب العملاء إلى تقنيات تعليم موثوقة. ومع ذلك، هناك تهديد جديد يعرف بهجوم PoisonedEvolution، والذي يستغل هذه العمليات الترويجية بطريقة مقلقة.
يعمل هجوم PoisonedEvolution عبر التلاعب بسجلات التجارب، حيث يمكن للتجار مشاهدة المهارة المستهدفة وتقديم أدلة محدودة, لكنهم لا يستطيعون مراقبة البُرْك الخصوصية أو منطق التطور أو تعديل بنك المهارات. يتطلب التسمم الأثري Inclusion، وEvolution Attribution، وRealization، حيث تعتبر Attribution عنق الزجاجة الرئيسي: يجب أن يبدو السلوك المستهدف مفيدًا سببيًا، ومتكررًا، وقابلًا للتعميم قبل الترويج.
التجارب أظهرت أن هذا الهجوم يمكن أن يُحقق نتائج مثيرة. ففي دراسات مختلفة، أظهر PoisonedEvolution قدرة على تضمين سلوكيات مستهدفة في 91% من المحاولات مع 10% دعم للمهاجم عبر ستة أنظمة لزيادة القدرة.
على الرغم من التقدم في تطوير الأنظمة الذاتية التطور، فإن الأمن يبقى تحديًا كبيرًا. تكشف هذه النتائج أهمية التأكد من سلامة الترويج والنقل للتقنيات حتى لا تتحول الأنظمة الذكية إلى مصدر خطورة. لذلك، يبقى السؤال: كيف يمكن تعزيز الأمان في وجه هذه التحديات الجديدة؟
الهجوم الذكي: كيف تتحول التجارب غير الموثوقة إلى مهارات موثوقة في النظم الذاتية التطور
تتحدث دراسة حديثة عن كيفية استغلال الأنظمة الذاتية التطور لتحويل تجارب غير موثوقة إلى تعليم موثوق عبر هجمة جديدة تُعرف باسم PoisonedEvolution. تقدم هذه التقنية تحديات أمنية جدية في عالم الذكاء الاصطناعي.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
