Command Palette
Search for a command to run...
MIRACL-VISION
Datum
Paper-URL
Lizenz
CC BY-SA 4.0
MIRACL-VISION ist ein von NVIDIA im Jahr 2025 veröffentlichtes mehrsprachiges visuelles Retrieval-Dataset, dessen zugehörige Forschungsergebnisse in der Arbeit „MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark" vorgestellt werden. Es dient der Bewertung mehrsprachiger, multimodaler Retrieval-Pipelines.
Das Dataset umfasst 7.898 Nutzerfragen und 338.734 Bilder aus Wikipedia-Artikeln mit entsprechenden Annotationen und unterstützt 18 Sprachen, darunter Arabisch, Bengalisch, Englisch, Spanisch, Persisch, Finnisch, Französisch, Hindi, Indonesisch, Japanisch, Koreanisch, Russisch, Swahili, Telugu, Thailändisch, Chinesisch und Yoruba.
Zusammensetzung des Datasets
-
Sprach-Untergruppen: Das Dataset umfasst 18 Sprachen, wobei jede Sprache einer eigenen Konfiguration (Config) und eigenen Datendateien entspricht.
-
Queries: Speichert die Nutzeranfragetexte im Parquet-Format.
-
Corpus: Speichert Wikipedia-Artikel und die zugehörigen Bilddaten im Parquet-Format.
-
Qrels: Speichert Relevanzinformationen zwischen Anfragen und Dokumenten im Parquet-Format.
-
Images: Speichert die mit den Dokumenten verknüpften Bilddaten im Parquet-Format.
Zitation
@misc{osmulsk2025miraclvisionlargemultilingualvisual,
title={MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark},
author={Radek Osmulsk and Gabriel de Souza P. Moreira and Ronay Ak and Mengyao Xu and Benedikt Schifferer and Even Oldridge},
year={2025},
eprint={2505.11651},
archivePrefix={arXiv},
primaryClass={cs.IR},
url={https://arxiv.org/abs/2505.11651},
}
KI mit KI entwickeln
Von der Idee bis zum Launch – beschleunigen Sie Ihre KI-Entwicklung mit kostenlosem KI-Co-Coding, sofort einsatzbereiter Umgebung und bestem GPU-Preis.