Command Palette
Search for a command to run...
ヴァーグデーヌ・サンスクリット語朗読コーパスデータセット
Vāgdhenuは、一人の人物によるサンスクリット語の詠唱を録音したコーパスであり、主にサンスクリット語の音声合成トレーニング、韻律研究、および言語アクセシビリティアプリケーションを目的としています。 このデータセットには1,467のセグメントが含まれており、音声の総再生時間は約5.3時間です。24kHzモノラルWAV形式で、style_aとstyle_bという2つの独立したサブセットがあり、多数の異なる詩句を網羅しています。音声処理では、文間の呼吸休止をなくし、特定のサンスクリット語の音素の発音特性を強調し、伝統的な古典朗誦の規範を厳守し、ヴェーダの音高変化を除外するというルールに従っています。
データセットの構成:
- style_a: 764クリップ、約2.70時間
- style_b: 703クリップ、約2.64時間
データフィールド:
- 公開フィールド: file_name (ファイル名)、text_devanagari (デーヴァナーガリー語サンスクリット語テキスト)、text_slp1 (SLP1ローマ字表記)、text_kannada (カンナダ語テキスト)、session (録音セッション)、take (録音セグメント数)
style\_aフィールドには、duration(セグメントの期間)とdeva(ソーステキストのカテゴリ)という特定の特性があります。style\_bフィールドには、meter(リズムと拍子)とn\_syll(音節数)という特定のフィールドが含まれています。
引用
音声および録音データは、いずれも著者であるVāgdhenuの著作物です。引用の際はVāgdhenuを明記してください。