Command Palette
Search for a command to run...
MIRACL-VISION
Date
URL du document
Licence
CC BY-SA 4.0
MIRACL-VISION est un ensemble de données de recherche visuelle multilingue publié par NVIDIA en 2025, dont les résultats de recherche associés sont présentés dans « MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark », visant à évaluer les pipelines de recherche multilingues et multimodaux.
Cet ensemble de données comprend 7 898 questions d'utilisateurs et 338 734 images d'articles Wikipédia avec leurs annotations correspondantes, prenant en charge 18 langues : arabe, bengali, anglais, espagnol, persan, finnois, français, hindi, indonésien, japonais, coréen, russe, swahili, télougou, thaï, chinois et yoruba.
Composition de l'ensemble de données
-
Sous-ensembles linguistiques : L'ensemble de données couvre 18 langues, chaque langue correspondant à une configuration (config) et à des fichiers de données indépendants.
-
Queries : Stocke les textes de requêtes des utilisateurs, au format Parquet.
-
Corpus : Stocke les articles Wikipédia et leurs données d'images associées, au format Parquet.
-
Qrels : Stocke les informations de pertinence entre les requêtes et les documents, au format Parquet.
-
Images : Stocke les données d'images associées aux documents, au format Parquet.
Citation
@misc{osmulsk2025miraclvisionlargemultilingualvisual,
title={MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark},
author={Radek Osmulsk and Gabriel de Souza P. Moreira and Ronay Ak and Mengyao Xu and Benedikt Schifferer and Even Oldridge},
year={2025},
eprint={2505.11651},
archivePrefix={arXiv},
primaryClass={cs.IR},
url={https://arxiv.org/abs/2505.11651},
}
Créer de l'IA avec l'IA
De l'idée au lancement — accélérez votre développement IA avec le co-codage IA gratuit, un environnement prêt à l'emploi et le meilleur prix pour les GPU.