Ailoxa Logo

🏷️ #توليد الصوت

16 مقال

أحدث تحول ثوري: تسريع نموذج IndexTTS-2 لتوليد الكلام النصي على وحدات معالجة الرسوميات!
أبحاث

أحدث تحول ثوري: تسريع نموذج IndexTTS-2 لتوليد الكلام النصي على وحدات معالجة الرسوميات!

أركايف للذكاءمنذ 15 ساعة
👁 1
إطار تقييم مبتكر لتحقيق توليد مؤثرات صوتية متقدمة!
أبحاث

إطار تقييم مبتكر لتحقيق توليد مؤثرات صوتية متقدمة!

أركايف للذكاءمنذ 10 يوم
👁 1
إطلاق الفئة الجديدة من الذكاء الاصطناعي: BackgroundMellow لصناعة الصوت السينمائي المتناغم!
أبحاث

إطلاق الفئة الجديدة من الذكاء الاصطناعي: BackgroundMellow لصناعة الصوت السينمائي المتناغم!

أركايف للذكاءمنذ 10 يوم
👁 1
ReGen: ثورة في نماذج الموجات الصوتية بواسطة توليد تمثيلات متعددة المستويات!
أبحاث

ReGen: ثورة في نماذج الموجات الصوتية بواسطة توليد تمثيلات متعددة المستويات!

أركايف للذكاءمنذ 11 يوم
👁 1
ثورة في توليد الصوت: إعادة استخدام مصنف الكلام لتعزيز نماذج الانحراف
أبحاث

ثورة في توليد الصوت: إعادة استخدام مصنف الكلام لتعزيز نماذج الانحراف

أركايف للذكاءمنذ 1 شهر
ابتكار ثوري في توليد مشاهد الصوت المتعدد: نموذج ScenA يغير قواعد اللعبة!
أبحاث

ابتكار ثوري في توليد مشاهد الصوت المتعدد: نموذج ScenA يغير قواعد اللعبة!

أركايف للذكاءمنذ 1 شهر
يوني فويس: نموذج موحّد لإنتاج الصوت والكلمات الساحرة
أبحاث

يوني فويس: نموذج موحّد لإنتاج الصوت والكلمات الساحرة

أركايف للذكاءمنذ 1 شهر
👁 2
تحقيق قفزة نوعية في توليد الصوت: دمج سلس بين الكلام والموسيقى من نصوص حرة!
أبحاث

تحقيق قفزة نوعية في توليد الصوت: دمج سلس بين الكلام والموسيقى من نصوص حرة!

أركايف للذكاءمنذ 1 شهر
تجاوز الفجوة بين الثبات والتعبيرية: الابتكار في نماذج اللغة المنطوقة
نماذج لغوية

تجاوز الفجوة بين الثبات والتعبيرية: الابتكار في نماذج اللغة المنطوقة

أركايف للذكاءمنذ 1 شهر
👁 1
ثورة في عالم الصوت: استكشف قوة Stable Audio 3 لتوليد وتحرير الصوت بسرعة مذهلة!
أبحاث

ثورة في عالم الصوت: استكشف قوة Stable Audio 3 لتوليد وتحرير الصوت بسرعة مذهلة!

أركايف للذكاءمنذ 2 شهر
ثورة في التعرف على الكلام: تعرفوا على TokenChain وميزاته الفريدة!
أبحاث

ثورة في التعرف على الكلام: تعرفوا على TokenChain وميزاته الفريدة!

أركايف للذكاءمنذ 2 شهر
Woosh: ثورة جديدة في نموذج تأثيرات الصوت من سوني الذكاء الاصطناعي
أدوات

Woosh: ثورة جديدة في نموذج تأثيرات الصوت من سوني الذكاء الاصطناعي

أركايف للذكاءمنذ 2 شهر
👁 1
ثورة الصوت: اكتشفوا Audio-Omni - الإطار الشامل لتوليد وتحرير الصوتيات!
أبحاث

ثورة الصوت: اكتشفوا Audio-Omni - الإطار الشامل لتوليد وتحرير الصوتيات!

أركايف للذكاءمنذ 2 شهر
UniSonate: نموذج مبتكر لتوليد الكلام والموسيقى وتأثيرات الصوت بتعليمات نصية موحدة!
أبحاث

UniSonate: نموذج مبتكر لتوليد الكلام والموسيقى وتأثيرات الصوت بتعليمات نصية موحدة!

أركايف للذكاءمنذ 2 شهر
استكشف قوة البرمجة مع Deepgram: دليل شامل لاستخدام SDK بايثون في تحويل النصوص والنطق ومعالجة الصوت
أدوات

استكشف قوة البرمجة مع Deepgram: دليل شامل لاستخدام SDK بايثون في تحويل النصوص والنطق ومعالجة الصوت

مارك تيك بوستمنذ 3 شهر
👁 1
احصل على تجربة استثنائية مع نظام Sora 2: النموذج الثوري لتوليد الفيديو والصوت!
أدوات

احصل على تجربة استثنائية مع نظام Sora 2: النموذج الثوري لتوليد الفيديو والصوت!

مدونة أوبن إيه آيمنذ 9 شهر
👁 1