HyperAI
Command Palette
Search for a command to run...
Vāgdhenu 梵语吟诵语料数据集
Vāgdhenu 是一个单人梵语吟诵录音语料库,主要面向梵语语音合成训练、韵律格律研究及语言无障碍应用等场景。 该数据集共包含 1,467 个片段,音频总时长约 5.3 小时,采用 24 kHz 单声道 WAV 格式,数据集包含 style_a 与 style_b 两个独立子集,覆盖大量不同诗节。音频处理遵循无句内间隙呼吸组规则,突出梵语特定音素的发音特征,严格遵循传统古典文献吟诵规范,且不含吠陀音高变化。
数据集构成:
- style_a:764 条片段,约 2.70 小时
- style_b:703 条片段,约 2.64 小时
数据字段:
- 公共字段:file_name(文件名), text_devanagari(天城体梵文文本), text_slp1(SLP1 罗马化转写), text_kannada(卡纳达语文本), session(录制场次), take(录制片段数)
- style_a 专属字段:duration(片段时长), deva(源文本分类)
- style_b 专属字段:meter(韵律格律), n_syll(音节数)
Citation
语音和录音均为作者 Vāgdhenu 本人所有。请引用 Vāgdhenu 。
此数据集由社区用户贡献,仅用于教育和信息目的。如有任何内容涉及版权侵权,请通过 [email protected] 联系我们,我们将及时审核并删除。