HyperAI
Command Palette
Search for a command to run...
How2QAビデオ+言語データセット

How2QA は、ビデオ + 言語学習フレームワーク データセットです。このデータセットは、選択されたビデオ クリップの同じセットを別の AMT ワーカー グループに提示し、多肢選択式の質問と回答のアノテーションを提供します。各作業者にはビデオ クリップが割り当てられ、用意された 4 つの回答 (正解 1 つと気を散らす回答 3 つ) に基づいて質問を書くように求められました。ビデオのナレーションは、集められた Q&A ペアが字幕によって隠されないようスタッフには隠されています。データセットには、9,035 のビデオから選択された 22,000 の 60 秒クリップと 44,007 の質問と回答のペアが含まれています。
引用
@inproceedings{li2020hero,
title={HERO: Hierarchical Encoder for Video+ Language Omni-representation Pre-training},
author={Li, Linjie and Chen, Yen-Chun and Cheng, Yu and Gan, Zhe and Yu, Licheng and Liu, Jingjing},
booktitle={EMNLP},
year={2020}
}
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。