HyperAIHyperAI

Command Palette

Search for a command to run...

Ensemble De Données De Paires image-texte CC12M

Discuter sur Discord

Date

il y a 4 ans

Organisation

Google Research

URL de publication

github.com

URL du document

arxiv.org

Licence

Other

Featured Image

CC12M (Conceptual 12M) est un ensemble de données de paires image-texte spécialement conçu pour la pré-formation de la vision et du langage. L'ensemble de données contient 12 millions de paires image-texte. Comparé à CC3M, cet ensemble de données est plus performant en matière de reconnaissance visuelle à longue traîne pour plusieurs tâches en aval.

Citation

@inproceedings{changpinyo2021cc12m, titre = {{Conceptual 12M} : Propulser le pré-entraînement image-texte à l’échelle du Web pour reconnaître les concepts visuels à longue traîne}, auteur = {Changpinyo, Soravit et Sharma, Piyush et Ding, Nan et Soricut, Radu}, titre du livre = {CVPR}, année = {2021}, }

Créer de l'IA avec l'IA

De l'idée au lancement — accélérez votre développement IA avec le co-codage IA gratuit, un environnement prêt à l'emploi et le meilleur prix pour les GPU.

Codage assisté par IA
GPU prêts à l’emploi
Tarifs les plus avantageux

HyperAI Newsletters

Abonnez-vous à nos dernières mises à jour
Nous vous enverrons les dernières mises à jour de la semaine dans votre boîte de réception à neuf heures chaque lundi matin
Propulsé par MailChimp