HyperAI
Command Palette
Search for a command to run...
Soul-Bench 오디오 기반 인간 애니메이션 평가 데이터 세트
Soul-Bench는 텐센트 유튜브 랩에서 2025년에 출시한 오디오 기반 인간 애니메이션 작업 평가 벤치마크입니다. 관련 연구 논문은 다음과 같습니다... 소울: 고품질 장기 멀티모달 애니메이션을 위해 디지털 휴먼에 생명을 불어넣으세요본 연구의 목표는 실제 응용 시나리오에서 관련 방법들의 생성 품질, 일관성 및 일반화 능력을 체계적으로 평가하는 것입니다. 이 데이터 세트는 226개의 비디오 테스트 샘플을 포함하며, 아래에 자세히 설명된 바와 같이 여러 차원에 걸쳐 비교적 풍부한 분포를 보여줍니다.
- 본체 유형 분포
- 상반신 노출 장면: 107개
- 전신 노출 장면: 72개
- 인물 사진, 애니메이션 캐릭터, 동물: 총 47개 항목
- 오디오 유형 배포
- 대화 기반 오디오: 177개 작품
- 성악 공연: 49곡
- 비디오 해상도 분포
- 1080P: 118개 항목
- 720P: 55개 항목
- 4K: 51개 항목
- 480P: 2개 품목
- 화면 비율
- 1 < r ≤ 2: 170개 항목
- r = 1 (정사각형): 44줄
- 0.5 ≤ r < 1 (수직): 12개 선
- 영상 길이 분포
- 27~30초 간격: 70줄

데이터 세트 예제
소환
@misc{soul,
title={Soul: Breathe Life into Digital Human for High-fidelity Long-term Multimodal Animation},
author={Jiangning Zhang and Junwei Zhu and Zhenye Gan and Donghao Luo and Chuming Lin and Feifan Xu and Xu Peng and Jianlong Hu and Yuansen Liu and Yijia Hong and Weijian Cao and Han Feng and Xu Chen and Chencan Fu and Keke He and Xiaobin Hu and Chengjie Wang},
year={2025},
eprint={2512.13495},
archivePrefix={arXiv},
primaryClass={cs.CV},
url={https://arxiv.org/abs/2512.13495},
}
이 데이터셋은 커뮤니티 사용자가 기여한 것이며 교육 및 정보 제공 목적으로만 사용됩니다. 저작권 침해와 관련된 콘텐츠가 있는 경우 [email protected]로 문의하시면 신속하게 검토 및 삭제 처리하겠습니다.