HyperAIHyperAI

Command Palette

Search for a command to run...

Naver bei der ActivityNet Challenge 2019 -- Aufgabe B: Active Speaker Detection (AVA)

Chung Joon Son

Zusammenfassung

Dieser Bericht beschreibt unsere Einreichung für die ActivityNet Challenge auf der CVPR 2019. Wir verwenden ein 3D-faltungsbasiertes Frontend und eine Kombination von zeitlichen Faltungs- und LSTM-Klassifikatoren, um vorherzusagen, ob eine sichtbare Person spricht oder nicht. Unsere Ergebnisse zeigen erhebliche Verbesserungen im Vergleich zur Baseline auf dem AVA-ActiveSpeaker-Datensatz.


KI mit KI entwickeln

Von der Idee bis zum Launch – beschleunigen Sie Ihre KI-Entwicklung mit kostenlosem KI-Co-Coding, sofort einsatzbereiter Umgebung und bestem GPU-Preis.

KI-gestütztes kollaboratives Programmieren
Sofort einsatzbereite GPUs
Die besten Preise

HyperAI Newsletters

Abonnieren Sie unsere neuesten Updates
Wir werden die neuesten Updates der Woche in Ihren Posteingang liefern um neun Uhr jeden Montagmorgen
Unterstützt von MailChimp