HyperAI
Command Palette
Search for a command to run...
DiDeMo 時間位置測位データセット

DiDeMo は Distinct Descriptable Moments の略で、自然言語による説明が与えられたビデオ内のイベントを時間的に特定するために使用できます。データセット内のビデオは Flickr から収集され、各ビデオは最大 30 秒のセグメントに編集されます。注釈の複雑さを軽減するために、データセット内のビデオは 5 秒ごとにセグメントに分割されます。 データ セットはトレーニング セット、検証セット、テスト セットに分割されており、それぞれ 8,395、1,065、1,004 個のビデオが含まれています。データセットには合計 26,892 のモーメントが含まれており、1 つのモーメントは複数のアノテーターによる記述に関連付けられている場合があります。 DiDeMo データセットの説明は詳細であり、カメラの動き、タイムシフト メトリクス、アクティビティが含まれます。さらに、このデータセット内の説明は、各説明が単一の瞬間を参照していることが検証されています。
引用
@inproceedings{hendricks18emnlp, タイトル = {時間言語を用いた動画内の瞬間位置特定} 著者 = {ヘンドリックス、リサ・アン、ワン、オリバー、シェヒトマン、イーライ、シビック、ジョセフ、ダレル、トレバー、ラッセル、ブライアン}、 書籍タイトル = {自然言語処理における経験的手法 (EMNLP)}、 年 = {2018} }
DiDeMo.torrent
シード中 0ダウンロード中 2完了 770総ダウンロード数 1,293
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。