HyperAIHyperAI

Command Palette

Search for a command to run...

強力なバックボーンと強力な特徴の融合――Ego4D Moment Queries Challenge におけるActionFormer

Fangzhou Mu Sicheng Mo Gillian Wang Yin Li

概要

本報告では、Ego4D Moment Queries Challenge 2022 への当チームの提出結果について記述する。本提出は、時系列行動定位(temporal action localization)の最先端モデルであるActionFormerをベースとし、SlowFast、Omnivore、EgoVLPの三つの強力な動画特徴量を統合したアプローチを採用している。この手法は、公開リーダーボードにおいて2位を獲得し、テストセットにおける平均mAPが21.76%に達した。これは公式ベースライン比でほぼ3倍の性能向上である。さらに、tIoU=0.5におけるRecall@1xは42.54%を達成し、1.41ポイントの絶対差でトップランカーを上回った。本研究のコードは、https://github.com/happyharrycn/actionformer_release にて公開されている。


AIでAIを構築

アイデアからローンチまで — 無料のAIコーディング支援、すぐに使える環境、最高のGPU価格でAI開発を加速。

AI コーディング補助
すぐに使える GPU
最適な料金体系

HyperAI Newsletters

最新情報を購読する
北京時間 毎週月曜日の午前9時 に、その週の最新情報をメールでお届けします
メール配信サービスは MailChimp によって提供されています