HyperAI
Command Palette
Search for a command to run...
VIRESET ビデオインスタンス編集データセット
このデータセットは、北京大学とOpenBayesベイジアンコンピューティングが2025年にリリースしたビデオインスタンス編集データセットです。関連する論文結果は次のとおりです。VIRES: スケッチとテキストによるガイド生成によるビデオインスタンスの再描画」は、ビデオインスタンスの再描画や時系列のセグメンテーションなどのタスクに正確な注釈サポートを提供することを目的としています。
このデータセットには以下が含まれます。
- SA-V はマスク注釈を強化し、元の JSON ファイルに新しい masklet_continues フィールドを追加します。これは、base64 デコードと pycocotools.mask ツールによって解析できます。
- 86,000 本のビデオ クリップ (85,000 本のトレーニング ビデオと 1,000 本の評価ビデオを含む) は、各ビデオが 51 フレームの 24 FPS、512×512 解像度の画像で構成され、一連の構造スケッチと外観のテキスト説明が添付されています。
ビデオ編集の例
引用
「`BibTeX @article{vires, title={VIRES: Sketchとテキスト誘導生成によるビデオインスタンスの再描画}, 著者={ウェン、シューチェンと鄭、ハオジエとチャン、ペイシュアンとホン、ユチェンとジャン、ハンとリー、シーとシー、ボクシン} ジャーナル={arXivプレプリント arXiv:2411.16199}、 年={2024} }
VIRESET.torrent
シード中 1ダウンロード中 0完了 75総ダウンロード数 160
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。