HyperAI
Command Palette
Search for a command to run...
HowToVQA69M 비디오 질의응답 데이터 세트

VQA는 시각적 질의응답을 의미합니다. HowToVQA69M은 69,270,581개의 질문과 답변을 포함하는 비디오 질문 답변 데이터 세트입니다. 기존 비디오 질의응답 데이터세트인 VideoQA의 두 배 규모입니다. 평균적으로 각 원시 영상은 12.1초 길이의 43개 영상 클립을 생성하며, 1.2개의 질문과 답변이 연결되어 있고, 질문에는 8.7개의 단어가, 답변에는 2.4개의 단어가 포함되어 있습니다. HowToVQA69M 데이터 세트는 매우 다양하며, 1,600만 개 이상의 고유 답변이 포함되어 있습니다. 이 중 200만 개 이상의 고유 답변이 두 번 이상 나타나고 30만 개 이상의 고유 답변이 10번 이상 나타납니다.
HowToVQA69M.torrent
시딩 중 2다운로드 중 0완료됨 686총 다운로드 635
이 데이터셋은 커뮤니티 사용자가 기여한 것이며 교육 및 정보 제공 목적으로만 사용됩니다. 저작권 침해와 관련된 콘텐츠가 있는 경우 [email protected]로 문의하시면 신속하게 검토 및 삭제 처리하겠습니다.