في خطوة تطورية في عالم معالجة الصوت، تم تقديم طريقة جديدة لنمذجة ضواغط الصوت الديناميكي البصري باستخدام نماذج الفضاء الانتقائي (Selective State Space Models). يعتمد هذا الابتكار على الشبكات العصبية العميقة، ويتمتع بقدرة على تجاوز الأساليب التقليدية المسندة على الطبقات المتكررة.
تحتوي التقنية الجديدة على كتلة الفضاء الانتقائي، التي تقوم بتشفير الإشارات الصوتية بشكل أكثر فعالية. كما تم الاستعانة بتقنيات متطورة تشمل التعديل الخطي حسب المميزات (Feature-wise Linear Modulation) ووحدات التحكم الخطية المحجوبة (Gated Linear Units)، لضبط الشبكة ديناميكيًا بما يتناسب مع معايير خارجية تؤثر في مراحل الهجوم والإفراج للضغط.
النموذج المقترح مناسب تماماً للتطبيقات ذات التأخير المنخفض والوقت الحقيقي، وهو أمر حاسم في معالجة الصوت الحي (live audio processing). تم اختبار الطريقة الجديدة على ضواغط صوتي أنالوج مشهورة مثل TubeTech CL 1B وTeletronix LA-2A، التي تمتاز بخصائصها الفريدة والمختلفة.
تم تقييم أداء الطريقة الجديدة عبر مؤشرات كمية واختبارات الاستماع الموضوعية، حيث أظهرت النتائج تفوق هذه الطريقة على النماذج الأخرى الأكثر حداثة، مما يحقق محاكاة دقيقة لعملية الضغط في كلٍ من الإعدادات المعروفة وغير المعروفة خلال تدريب النموذج. كما تم تحديد تأثير كثافة العينات لمعايير التحكم في مجموعة البيانات، وكان الإعدادات ذات الهجوم السريع والإفراج البطيء هي الأكثر تحدياً للمحاكاة بدقة.
مع مزيد من الابتكار في تقنية الضغط الصوتي البصري، تفتح هذه النتائج أبواباً جديدة في مجال معالجة الصوت، لا سيما في البيئات التي تتطلب استجابة سريعة وفعالة.
نموذج جديد لتقنيات الضغط الضوئي الثنائي: ثورة في معالجة الصوت الديناميكي
تقدم طريقة جديدة لنمذجة ضواغط الصوت باستخدام الشبكات العصبية العميقة، مما يحقق دقة أعلى في معالجة الإشارات الصوتية. تعتمد التقنية المستخدمة على نموذج الفضاء الحالى الانتقائي وعناصر التحكم الديناميكية، لتقديم أداء متفوق في التطبيقات الزمن الحقيقي.
المصدر الأصلي:أركايف للذكاء
زيارة المصدر الأصلي ←جاري تحميل التفاعلات...
