Command Palette
Search for a command to run...
GLOBE_V2 Ensemble De Données Vocales D'anglais Avec Accents Du Monde Entier
L’ensemble de données GLOBE est un corpus vocal anglais de haute qualité publié en 2024. L'article scientifique associé s’intitule « GLOBE : Un corpus anglais de haute qualité avec des accents mondiaux pour la synthèse vocale adaptative au locuteur sans échantillon » (https://hyper.ai/papers/2406.14875), et vise à résoudre le problème de faible généralisation des systèmes de synthèse vocale adaptatifs aux locuteurs dans un contexte zéro-échantillon face aux locuteurs présentant divers accents.
Cet ensemble contient 535 heures de données audio échantillonnées à 24 kHz, provenant de 23 519 locuteurs couvrant 164 accents du monde entier, accompagné de métadonnées détaillées sur les locuteurs. La version GLOBE_V2 propose quant à elle une fréquence d’échantillonnage de 44,1 kHz tout en supprimant environ 5 % d’échantillons comportant des anomalies de volume ou des problèmes d’alignement entre l’audio et le texte, améliorant ainsi davantage la qualité des données.
Référence bibliographique
@misc{wang2024globe,
title={GLOBE: A High-quality English Corpus with Global Accents for Zero-shot Speaker Adaptive Text-to-Speech},
author={Wenbin Wang and Yang Song and Sanjay Jha},
year={2024},
eprint={2406.14875},
archivePrefix={arXiv},
}
Créer de l'IA avec l'IA
De l'idée au lancement — accélérez votre développement IA avec le co-codage IA gratuit, un environnement prêt à l'emploi et le meilleur prix pour les GPU.