HyperAIHyperAI

Command Palette

Search for a command to run...

Vāgdhenu 梵语吟诵语料数据集

日期

2 小时前

许可证

CC BY 4.0

Vāgdhenu 是一个单人梵语吟诵录音语料库,主要面向梵语语音合成训练、韵律格律研究及语言无障碍应用等场景。 该数据集共包含 1,467 个片段,音频总时长约 5.3 小时,采用 24 kHz 单声道 WAV 格式,数据集包含 style_a 与 style_b 两个独立子集,覆盖大量不同诗节。音频处理遵循无句内间隙呼吸组规则,突出梵语特定音素的发音特征,严格遵循传统古典文献吟诵规范,且不含吠陀音高变化。

数据集构成:

  • style_a:764 条片段,约 2.70 小时
  • style_b:703 条片段,约 2.64 小时

数据字段:

  • 公共字段:file_name(文件名), text_devanagari(天城体梵文文本), text_slp1(SLP1 罗马化转写), text_kannada(卡纳达语文本), session(录制场次), take(录制片段数)
  • style_a 专属字段:duration(片段时长), deva(源文本分类)
  • style_b 专属字段:meter(韵律格律), n_syll(音节数)

Citation

语音和录音均为作者 Vāgdhenu 本人所有。请引用 Vāgdhenu 。

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码
开箱即用的 GPU
最优定价

HyperAI Newsletters

订阅我们的最新资讯
我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新
邮件发送服务由 MailChimp 提供