HyperAI
Command Palette
Search for a command to run...
ビジュアルゲノムの密に注釈が付けられたデータセット
日付
サイズ
15.31 GB
公開URL
Paper URL
ライセンス
CC BY 4.0

Visual Genome Dataset は、クラウドソーシングの高密度画像アノテーションを通じて言語と視覚を結び付けるデータ セットであり、多肢選択環境での Visual Question Answering データが含まれています。 このデータセットには、101,174 個の MSCOCO 画像からなる 170 万個の QA ペアが含まれており、画像ごとに平均 17 個の質問があります。 Visual Question Answering データ セットと比較して、Visual Genome データ セットには、「何を、どこで、いつ、誰が、なぜ、どのように」の 6 種類の質問がよりバランスよく分散されています。さらに、Visual Genome は、オブジェクト、属性、および関係性の注釈が密に付けられた 108,000 枚の画像を表示します。
Visual_Genome_Dataset.torrent
シード中 2ダウンロード中 0完了 807総ダウンロード数 1,106
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。