HyperAIHyperAI

Command Palette

Search for a command to run...

التركيب الصوتي العصبي باللغة الألمانية

René Peinl Pascal Puchtler Johannes Wirth

الملخص

بينما يتم تقييم العديد من أنظمة توليد الكلام القائمة على الشبكات العصبية العميقة بشكل شامل وإتاحتها مجانًا للاستخدام باللغة الإنجليزية، فإن النماذج المخصصة للغات التي يتحدثها عدد محدود من الأشخاص، مثل الألمانية، نادرًا ما تُدرَّب، وأكثر من ذلك، لا تُنشر عادةً للاستخدام العام. تتناول هذه الدراسة التحديات الخاصة بتدريب نماذج تحويل النص إلى كلام للغة الألمانية، بما في ذلك اختيار مجموعة البيانات والمعالجة الأولية للبيانات، وتقديم عملية التدريب لعدة نماذج لنظام توليد كلام نهائياً يعتمد على مزيج من تاكوترون 2 (Tacotron 2) وميل جان متعددة الأشرطة (Multi-Band MelGAN). تم تقييم جميع تراكيب النماذج مقابل درجة التقييم المتوسطة من قبل المستخدمين (Mean Opinion Score)، وقد أظهرت النتائج نتائج مماثلة لتلك المُحقَّقة في الأدبيات العلمية الخاصة بنماذج مدرَّبة ومُختبرة على مجموعات بيانات باللغة الإنجليزية. بالإضافة إلى ذلك، أظهرت التحليلات التجريبية جوانب مميزة تؤثر على جودة هذه الأنظمة، استنادًا إلى تجربة المستخدمين ذاتية التقييم. تم إتاحة جميع النماذج المدربة للاستخدام العام.


بناء الذكاء الاصطناعي بالذكاء الاصطناعي

من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.

البرمجة التعاونية باستخدام الذكاء الاصطناعي
وحدات GPU جاهزة للعمل
أفضل الأسعار

HyperAI Newsletters

اشترك في آخر تحديثاتنا
سنرسل لك أحدث التحديثات الأسبوعية إلى بريدك الإلكتروني في الساعة التاسعة من صباح كل يوم اثنين
مدعوم بواسطة MailChimp
التركيب الصوتي العصبي باللغة الألمانية | مستندات | HyperAI