Command Palette
Search for a command to run...
Ensemble De Données Du Corpus De Récitation Sanskrite De Vāgdhenu
Vāgdhenu est un corpus de chants sanskrits enregistrés par une seule personne, principalement destiné à la formation à la synthèse vocale sanskrite, à la recherche sur la prosodie et le mètre, et aux applications d'accessibilité linguistique. Ce corpus contient 1 467 segments, pour une durée audio totale d'environ 5,3 heures. Il est au format WAV mono 24 kHz et comprend deux sous-ensembles indépendants, style_a et style_b, couvrant un grand nombre de versets différents. Le traitement audio respecte la règle de l'absence de pauses respiratoires entre les phrases, mettant en évidence les caractéristiques de prononciation de certains phonèmes sanskrits, conformément aux normes de la récitation classique traditionnelle et en excluant les variations de hauteur védiques.
Composition de l'ensemble de données :
- style_a : 764 clips, environ 2,70 heures
- style_b : 703 clips, environ 2,64 heures
Champs de données :
- Champs publics : file_name (nom du fichier), text_devanagari (texte sanskrit en devanagari), text_slp1 (transcription romanisée SLP1), text_kannada (texte en kannada), session (session d’enregistrement), take (nombre de segments enregistrés)
- Le champ
style\_apossède les caractéristiques spécifiques suivantes :duration(durée du segment) etdeva(catégorie du texte source). - Le champ
style\_bcontient les champs spécifiques suivants :meter(rythme et mètre) etn\_syll(nombre de syllabes).
Citation
L'audio et les enregistrements sont la propriété de l'auteur, Vāgdhenu. Veuillez citer Vāgdhenu.
Créer de l'IA avec l'IA
De l'idée au lancement — accélérez votre développement IA avec le co-codage IA gratuit, un environnement prêt à l'emploi et le meilleur prix pour les GPU.