HyperAIHyperAI

Command Palette

Search for a command to run...

바그데누 산스크리트어 암송 코퍼스 데이터셋

날짜

하루 전

라이선스

CC BY 4.0

Vāgdhenu는 한 사람이 녹음한 산스크리트어 낭송 모음집으로, 주로 산스크리트어 음성 합성 훈련, 운율 및 운율 연구, 언어 접근성 향상 애플리케이션에 사용될 목적으로 제작되었습니다. 이 데이터셋은 총 1,467개의 세그먼트로 구성되어 있으며, 전체 오디오 재생 시간은 약 5.3시간입니다. 24kHz 모노 WAV 형식이며, style_a와 style_b라는 두 개의 독립적인 하위 집합으로 나뉘어 다양한 구절들을 포함하고 있습니다. 오디오 처리 과정에서는 문장 간 호흡으로 인한 멈춤을 없애고, 특정 산스크리트어 음소의 발음 특징을 강조하며, 전통적인 고전 암송 방식을 엄격히 준수하고, 베다 음조 변화를 배제했습니다.

데이터셋 구성:

  • style_a: 클립 764개, 약 2.70시간
  • style_b: 클립 703개, 약 2.64시간

데이터 필드:

  • 공개 필드: file_name(파일 이름), text_devanagari(데바나가리 산스크리트어 텍스트), text_slp1(SLP1 로마자 표기), text_kannada(칸나다어 텍스트), session(녹음 세션), take(녹음된 세그먼트 수)
  • style\_a 필드는 duration(세그먼트 지속 시간) 및 deva(원본 텍스트 범주)와 같은 특정 특성을 가지고 있습니다.
  • style\_b 필드에는 meter(리듬 및 박자)와 n\_syll(음절 수)이라는 특정 필드가 포함되어 있습니다.

소환

오디오 파일과 녹음 파일은 모두 저작권자 바그데누(Vāgdhenu)의 소유입니다. 인용 시에는 반드시 바그데누를 명시해 주십시오.

AI로 AI 구축

아이디어에서 출시까지 — 무료 AI 코코딩, 즉시 사용 가능한 환경, 최적의 GPU 가격으로 AI 개발을 가속화하세요.

AI 협업 코딩
바로 사용 가능한 GPU
최적의 가격

HyperAI Newsletters

최신 정보 구독하기
한국 시간 매주 월요일 오전 9시 에 이번 주의 최신 업데이트를 메일로 발송합니다
이메일 서비스 제공: MailChimp