في عالم الذكاء الاصطناعي، تعرف نماذج اللغة الكبيرة (LLMs) باعتمادها المتزايد على هذه التكنولوجيا. ولكن، كشفت دراسات حديثة عن وجود ثغرات يمكن استغلالها لأغراض ضارة، وخاصة في النماذج الصوتية المتكاملة (E2E).
يسلط البحث الجديد الضوء على نوع جديد من هجمات حرمان الخدمة (DoS) تستهدف هذه النماذج الصوتية، حيث يستفيد المهاجمون من المدخلات المصممة بشكل دقيق لخلق مخرجات طويلة بشكل مفرط. بينما كانت معظم هجمات DoS السابقة تستهدف نماذج اللغة النصية، لاحظ الباحثون أن النماذج الصوتية لم تحظ بتركيز كافٍ في هذا الجانب.
تشير الدراسة إلى أن الهجوم يعتمد على تقنية تضخيم ضوضاء غير قابلة للاكتشاف، مما يؤدي إلى زيادة طول المخرجات دون التأثير على طول المدخلات الأصلية أو محتواها الدلالي. من خلال استخدام تقنيات متقدمة مثل الكشف عن النشاط الصوتي (VAD)، تستطيع هذه الهجمات إدخال الضوضاء فقط في المناطق الصوتية، مما يجعل من الصعب رصدها أو اكتشافها.
تظهر التجارب على ثلاثة نماذج صوتية متكاملة مفتوحة المصدر أن هذه الاستراتيجية تؤدي إلى زيادة فعالة في استهلاك موارد معالجة وحدة المعالجة الرسومية (GPU) وتعكس المخاطر الأمنية التي تواجه نماذج اللغة الصوتية الحديثة.
في ضوء هذه النتائج، يعتبر من الضروري التحقيق في آليات حماية أقوى للنماذج الصوتية المتكاملة لتحقيق أمان أكبر. كيف ترون مستقبل هذه التكنولوجيا في سياق الأمان؟ شاركونا أفكاركم في التعليقات!
اجعل الصوت لا يتوقف: هجوم حرمان الخدمة على نماذج اللغة الصوتية المتكاملة
توصلت دراسات جديدة إلى أن نماذج اللغة الصوتية المتكاملة (E2E) عرضة لهجمات حرمان الخدمة (DoS). هذه الهجمات تستخدم تقنيات جديدة لتعزيز استهلاك الموارد وزيادة طول المخرجات بشكل غير مسبوق.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
