Command Palette
Search for a command to run...
We-Math2.0-표준 시각적 수학적 추론 벤치마크 데이터 세트
*이 데이터 세트는 온라인 사용을 지원합니다.여기를 클릭하여 이동하세요.
We-Math2.0-Standard는 베이징우전대학교, 텐센트, 칭화대학교가 2025년에 발표한 시각적 수학적 추론을 위한 표준 데이터셋입니다. 관련 논문 결과는 다음과 같습니다.WE-MATH 2.0: 시각적 수학적 추론을 장려하는 다재다능한 MathBook 시스템"는 진단 가능하고 설명 가능하며 비교 가능한 평가 기준을 제공하는 것을 목표로 합니다. 이 데이터세트는 1,819개의 정확하게 정의된 지식 원리를 중심으로 통합 레이블 공간을 구축하고, 각 질문에 해당 원리를 명시적으로 주석으로 달고 엄격하게 큐레이션하여 전반적으로 광범위하고 균형 잡힌 커버리지를 달성합니다. 특히 이전에는 제대로 표현되지 않았던 수학 하위 분야와 질문 유형을 강화합니다. 이 데이터세트는 이중 확장 설계를 채택합니다.
- 첫째, 질문당 여러 이미지를 사용하여 다양한 출처의 시각적 증거의 통합과 정렬을 테스트합니다.
- 둘째, 이미지당 여러 질문을 사용하여 동일한 시각적 맥락에서 다중 원리 전달과 개념적 유연성을 테스트합니다.
각 예시는 이미지와 텍스트 줄기로 구성되어 있으며, 질문에 필요한 지식 원칙과 표준 답변에 대한 주석이 함께 제공됩니다.

데이터 세트 개요
소환
@misc{qiao2025wemath20versatilemathbook,
title={We-Math 2.0: A Versatile MathBook System for Incentivizing Visual Mathematical Reasoning},
author={Runqi Qiao and Qiuna Tan and Peiqing Yang and Yanzi Wang and Xiaowan Wang and Enhui Wan and Sitong Zhou and Guanting Dong and Yuchen Zeng and Yida Xu and Jie Wang and Chong Sun and Chen Li and Honggang Zhang},
year={2025},
eprint={2508.10433},
archivePrefix={arXiv},
primaryClass={cs.AI},
url={https://arxiv.org/abs/2508.10433},
}