Ailoxa Logo

🏷️ #توليد الصوت

19 مقال

PRISM-Bench: معيار تشخيصي مبتكر لتوليد الصوت والفيديو من النص!
أبحاث

PRISM-Bench: معيار تشخيصي مبتكر لتوليد الصوت والفيديو من النص!

أركايف للذكاءمنذ 20 ساعة
👁 1
فيز ويف: نموذج مبتكر لتوليد الصوت المكاني من النصوص باستخدام الفيزياء
أبحاث

فيز ويف: نموذج مبتكر لتوليد الصوت المكاني من النصوص باستخدام الفيزياء

أركايف للذكاءمنذ 6 يوم
تطور ثوري في توليد الصوت: تقنيات فعالة لتحسين الأداء وجودة الصوت
أبحاث

تطور ثوري في توليد الصوت: تقنيات فعالة لتحسين الأداء وجودة الصوت

أركايف للذكاءمنذ 1 شهر
👁 2
أحدث تحول ثوري: تسريع نموذج IndexTTS-2 لتوليد الكلام النصي على وحدات معالجة الرسوميات!
أبحاث

أحدث تحول ثوري: تسريع نموذج IndexTTS-2 لتوليد الكلام النصي على وحدات معالجة الرسوميات!

أركايف للذكاءمنذ 1 شهر
👁 2
إطار تقييم مبتكر لتحقيق توليد مؤثرات صوتية متقدمة!
أبحاث

إطار تقييم مبتكر لتحقيق توليد مؤثرات صوتية متقدمة!

أركايف للذكاءمنذ 1 شهر
👁 2
إطلاق الفئة الجديدة من الذكاء الاصطناعي: BackgroundMellow لصناعة الصوت السينمائي المتناغم!
أبحاث

إطلاق الفئة الجديدة من الذكاء الاصطناعي: BackgroundMellow لصناعة الصوت السينمائي المتناغم!

أركايف للذكاءمنذ 1 شهر
👁 1
ReGen: ثورة في نماذج الموجات الصوتية بواسطة توليد تمثيلات متعددة المستويات!
أبحاث

ReGen: ثورة في نماذج الموجات الصوتية بواسطة توليد تمثيلات متعددة المستويات!

أركايف للذكاءمنذ 1 شهر
👁 1
ثورة في توليد الصوت: إعادة استخدام مصنف الكلام لتعزيز نماذج الانحراف
أبحاث

ثورة في توليد الصوت: إعادة استخدام مصنف الكلام لتعزيز نماذج الانحراف

أركايف للذكاءمنذ 2 شهر
ابتكار ثوري في توليد مشاهد الصوت المتعدد: نموذج ScenA يغير قواعد اللعبة!
أبحاث

ابتكار ثوري في توليد مشاهد الصوت المتعدد: نموذج ScenA يغير قواعد اللعبة!

أركايف للذكاءمنذ 2 شهر
يوني فويس: نموذج موحّد لإنتاج الصوت والكلمات الساحرة
أبحاث

يوني فويس: نموذج موحّد لإنتاج الصوت والكلمات الساحرة

أركايف للذكاءمنذ 3 شهر
👁 2
تحقيق قفزة نوعية في توليد الصوت: دمج سلس بين الكلام والموسيقى من نصوص حرة!
أبحاث

تحقيق قفزة نوعية في توليد الصوت: دمج سلس بين الكلام والموسيقى من نصوص حرة!

أركايف للذكاءمنذ 3 شهر
👁 1
تجاوز الفجوة بين الثبات والتعبيرية: الابتكار في نماذج اللغة المنطوقة
نماذج لغوية

تجاوز الفجوة بين الثبات والتعبيرية: الابتكار في نماذج اللغة المنطوقة

أركايف للذكاءمنذ 3 شهر
👁 2
ثورة في عالم الصوت: استكشف قوة Stable Audio 3 لتوليد وتحرير الصوت بسرعة مذهلة!
أبحاث

ثورة في عالم الصوت: استكشف قوة Stable Audio 3 لتوليد وتحرير الصوت بسرعة مذهلة!

أركايف للذكاءمنذ 3 شهر
ثورة في التعرف على الكلام: تعرفوا على TokenChain وميزاته الفريدة!
أبحاث

ثورة في التعرف على الكلام: تعرفوا على TokenChain وميزاته الفريدة!

أركايف للذكاءمنذ 4 شهر
Woosh: ثورة جديدة في نموذج تأثيرات الصوت من سوني الذكاء الاصطناعي
أدوات

Woosh: ثورة جديدة في نموذج تأثيرات الصوت من سوني الذكاء الاصطناعي

أركايف للذكاءمنذ 4 شهر
👁 1
ثورة الصوت: اكتشفوا Audio-Omni - الإطار الشامل لتوليد وتحرير الصوتيات!
أبحاث

ثورة الصوت: اكتشفوا Audio-Omni - الإطار الشامل لتوليد وتحرير الصوتيات!

أركايف للذكاءمنذ 4 شهر
👁 2
UniSonate: نموذج مبتكر لتوليد الكلام والموسيقى وتأثيرات الصوت بتعليمات نصية موحدة!
أبحاث

UniSonate: نموذج مبتكر لتوليد الكلام والموسيقى وتأثيرات الصوت بتعليمات نصية موحدة!

أركايف للذكاءمنذ 4 شهر
👁 1
استكشف قوة البرمجة مع Deepgram: دليل شامل لاستخدام SDK بايثون في تحويل النصوص والنطق ومعالجة الصوت
أدوات

استكشف قوة البرمجة مع Deepgram: دليل شامل لاستخدام SDK بايثون في تحويل النصوص والنطق ومعالجة الصوت

مارك تيك بوستمنذ 4 شهر
👁 1
احصل على تجربة استثنائية مع نظام Sora 2: النموذج الثوري لتوليد الفيديو والصوت!
أدوات

احصل على تجربة استثنائية مع نظام Sora 2: النموذج الثوري لتوليد الفيديو والصوت!

مدونة أوبن إيه آيمنذ 11 شهر
👁 3