Command Palette
Search for a command to run...
Vāgdhenu Sanskrit Recitation Corpus Dataset
Vāgdhenu ist ein Korpus von aufgezeichneten Sanskrit-Gesängen einer einzelnen Person, der in erster Linie für das Training der Sanskrit-Sprachsynthese, die Prosodie- und Metrikforschung sowie für Anwendungen zur Barrierefreiheit von Sprachen gedacht ist. Dieser Datensatz umfasst 1467 Segmente mit einer Gesamtlänge von ca. 5,3 Stunden. Er liegt im 24-kHz-Mono-WAV-Format vor und enthält zwei unabhängige Teilmengen, style_a und style_b, die eine Vielzahl verschiedener Verse abdecken. Die Audioverarbeitung folgt der Regel, dass keine Atempausen zwischen den Sätzen entstehen, hebt die Aussprachemerkmale spezifischer Sanskrit-Phoneme hervor, hält sich strikt an die Normen der traditionellen klassischen Rezitation und schließt vedische Tonhöhenvariationen aus.
Zusammensetzung des Datensatzes:
- Stil_a: 764 Clips, ca. 2,70 Stunden
- Stil_b: 703 Clips, ca. 2,64 Stunden
Datenfelder:
- Öffentliche Felder: file_name (Dateiname), text_devanagari (Devanagari-Sanskrit-Text), text_slp1 (SLP1-Romanisierte Transliteration), text_kannada (Kannada-Text), session (Aufnahmesitzung), take (Anzahl der aufgenommenen Segmente)
- Das Feld
style\_ahat folgende spezifische Eigenschaften:duration(Segmentdauer) unddeva(Quelltextkategorie). - Das Feld
style\_benthält die folgenden spezifischen Felder:meter(Rhythmus und Metrum) undn\_syll(Anzahl der Silben).
Zitat
Sowohl die Audioaufnahmen als auch die Tonaufnahmen sind Eigentum des Autors Vāgdhenu. Bitte geben Sie Vāgdhenu als Quelle an.
KI mit KI entwickeln
Von der Idee bis zum Launch – beschleunigen Sie Ihre KI-Entwicklung mit kostenlosem KI-Co-Coding, sofort einsatzbereiter Umgebung und bestem GPU-Preis.