HyperAIHyperAI

Command Palette

Search for a command to run...

ViTT Dense 비디오 설명 데이터 세트

Discord에서 논의하기

날짜

조직

게시 URL

github.com

Paper URL

arxiv.org

라이선스

Other

Featured Image

ViTT는 비디오 타임라인 태그를 의미하며, 수동으로 생성된 세그먼트 수준의 주석이 포함된 8,169개의 비디오로 구성되어 있습니다. 이 중 5,840개의 영상은 한 번 주석이 달렸고, 나머지 영상은 두 번 이상 주석이 달렸습니다. 이 데이터 세트에 대해 총 12,461개의 주석 세트가 공개되었습니다. 이 데이터 세트의 비디오는 Youtube-8M 데이터 세트에서 가져왔습니다.

소환

@inproceedings{huang2020multimodal, 제목={밀집 비디오 캡션 생성을 위한 멀티모달 사전 학습}, 작성자={Huang, Gabriel 및 Pang, Bo 및 Zhu, Zhenhai 및 Rivera, Clara 및 Soricut, Radu}, 책 제목={AACL-IJCNLP 2020}, 년도={2020} }

AI로 AI 구축

아이디어에서 출시까지 — 무료 AI 코코딩, 즉시 사용 가능한 환경, 최적의 GPU 가격으로 AI 개발을 가속화하세요.

AI 협업 코딩
바로 사용 가능한 GPU
최적의 가격

HyperAI Newsletters

최신 정보 구독하기
한국 시간 매주 월요일 오전 9시 에 이번 주의 최신 업데이트를 메일로 발송합니다
이메일 서비스 제공: MailChimp