Ailoxa Logo

🏷️ #معالجة الصوت

9 مقال

تعلم التوافق الزمني والترددي: ثورة في الكشف عن فيديوهات الديب فيك الصوتية
أبحاث

تعلم التوافق الزمني والترددي: ثورة في الكشف عن فيديوهات الديب فيك الصوتية

أركايف للذكاءمنذ 3 يوم
👁 1
ثورة جديدة في الإجابة على الأسئلة: تقنيات الذكاء الاصطناعي تعيد تعريف معالجة الصوت الطويل
أبحاث

ثورة جديدة في الإجابة على الأسئلة: تقنيات الذكاء الاصطناعي تعيد تعريف معالجة الصوت الطويل

أركايف للذكاءمنذ 1 شهر
VocSim: ثورة جديدة في تحديد هوية المحتوى الصوتي بدون تدريب!
أبحاث

VocSim: ثورة جديدة في تحديد هوية المحتوى الصوتي بدون تدريب!

أركايف للذكاءمنذ 1 شهر
👁 1
دليل الابتكار في علم الصوتيات: DSA-Tokenizer ينقلب على مجالات الذكاء الاصطناعي
أدوات

دليل الابتكار في علم الصوتيات: DSA-Tokenizer ينقلب على مجالات الذكاء الاصطناعي

أركايف للذكاءمنذ 1 شهر
ثورة جديدة في تحسين الصوت: نموذج DriftSE يعمل على تحويل الصوت النقي في خطوة واحدة!
أبحاث

ثورة جديدة في تحسين الصوت: نموذج DriftSE يعمل على تحويل الصوت النقي في خطوة واحدة!

أركايف للذكاءمنذ 2 شهر
استكشف قوة البرمجة مع Deepgram: دليل شامل لاستخدام SDK بايثون في تحويل النصوص والنطق ومعالجة الصوت
أدوات

استكشف قوة البرمجة مع Deepgram: دليل شامل لاستخدام SDK بايثون في تحويل النصوص والنطق ومعالجة الصوت

مارك تيك بوستمنذ 3 شهر
👁 1
تقييم التفكير الصوتي: كيف تعزز نماذج الذكاء الاصطناعي فهمنا للأصوات؟
أبحاث

تقييم التفكير الصوتي: كيف تعزز نماذج الذكاء الاصطناعي فهمنا للأصوات؟

هاجينج فيسمنذ 19 شهر
التشفير التكهنّي: هل سيضاعف سرعة ترميز Whisper؟
أبحاث

التشفير التكهنّي: هل سيضاعف سرعة ترميز Whisper؟

هاجينج فيسمنذ 31 شهر
تعزيز Wav2Vec2 باستخدام n-grams: ثورة جديدة في معالجة الصوت!
أبحاث

تعزيز Wav2Vec2 باستخدام n-grams: ثورة جديدة في معالجة الصوت!

هاجينج فيسمنذ 55 شهر