HyperAI
Command Palette
Search for a command to run...
MIRACL-VISION
MIRACL-VISION は、NVIDIA が 2025 年に公開した多言語ビジュアル検索データセットであり、関連する論文成果は「MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark」です。多言語・マルチモーダル検索パイプラインを評価することを目的としています。
このデータセットには、7,898 件のユーザー質問と 338,734 枚のウィキペディア記事画像および対応するアノテーションが含まれており、アラビア語、ベンガル語、英語、スペイン語、ペルシャ語、フィンランド語、フランス語、ヒンディー語、インドネシア語、日本語、韓国語、ロシア語、スワヒリ語、テルグ語、タイ語、中国語、ヨルバ語など 18 言語をサポートしています。
データセット構成
-
言語サブセット:データセットは 18 言語をカバーし、各言語に対応する独立した設定(config)とデータファイルがあります。
-
Queries:ユーザー検索テキストを格納し、Parquet 形式で提供されます。
-
Corpus:ウィキペディア記事と対応する画像データを格納し、Parquet 形式で提供されます。
-
Qrels:クエリとドキュメント間の関連性情報を格納し、Parquet 形式で提供されます。
-
Images:ドキュメントに関連する画像データを格納し、Parquet 形式で提供されます。
Citation
@misc{osmulsk2025miraclvisionlargemultilingualvisual,
title={MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark},
author={Radek Osmulsk and Gabriel de Souza P. Moreira and Ronay Ak and Mengyao Xu and Benedikt Schifferer and Even Oldridge},
year={2025},
eprint={2505.11651},
archivePrefix={arXiv},
primaryClass={cs.IR},
url={https://arxiv.org/abs/2505.11651},
}
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。