HyperAIHyperAI

Command Palette

Search for a command to run...

ヴァーグデーヌ・サンスクリット語朗読コーパスデータセット

日付

2時間前

ライセンス

CC BY 4.0

Vāgdhenuは、一人の人物によるサンスクリット語の詠唱を録音したコーパスであり、主にサンスクリット語の音声合成トレーニング、韻律研究、および言語アクセシビリティアプリケーションを目的としています。 このデータセットには1,467のセグメントが含まれており、音声の総再生時間は約5.3時間です。24kHzモノラルWAV形式で、style_aとstyle_bという2つの独立したサブセットがあり、多数の異なる詩句を網羅しています。音声処理では、文間の呼吸休止をなくし、特定のサンスクリット語の音素の発音特性を強調し、伝統的な古典朗誦の規範を厳守し、ヴェーダの音高変化を除外するというルールに従っています。

データセットの構成:

  • style_a: 764クリップ、約2.70時間
  • style_b: 703クリップ、約2.64時間

データフィールド:

  • 公開フィールド: file_name (ファイル名)、text_devanagari (デーヴァナーガリー語サンスクリット語テキスト)、text_slp1 (SLP1ローマ字表記)、text_kannada (カンナダ語テキスト)、session (録音セッション)、take (録音セグメント数)
  • style\_aフィールドには、duration(セグメントの期間)とdeva(ソーステキストのカテゴリ)という特定の特性があります。
  • style\_bフィールドには、meter(リズムと拍子)とn\_syll(音節数)という特定のフィールドが含まれています。

引用

音声および録音データは、いずれも著者であるVāgdhenuの著作物です。引用の際はVāgdhenuを明記してください。

AIでAIを構築

アイデアからローンチまで — 無料のAIコーディング支援、すぐに使える環境、最高のGPU価格でAI開発を加速。

AI コーディング補助
すぐに使える GPU
最適な料金体系

HyperAI Newsletters

最新情報を購読する
北京時間 毎週月曜日の午前9時 に、その週の最新情報をメールでお届けします
メール配信サービスは MailChimp によって提供されています