HyperAIHyperAI

Command Palette

Search for a command to run...

CC-OCR 텍스트 인식 데이터 세트

날짜

일 년 전

크기

1.49 GB

조직

华南理工大学
Alibaba Group
华中科技大学

게시 URL

github.com

Paper URL

arxiv.org

CC-OCR 데이터 세트는 알리바바 그룹, 화중과학기술대학교, 남중국이공대학교가 2024년에 공동으로 개발한 것으로, 텍스트 인식(OCR) 작업에서 대규모 멀티모달 모델의 성능을 평가하기 위한 포괄적이고 까다로운 벤치마크를 제공합니다.CC-OCR: 문해력 분야의 대규모 다중 모드 모델을 평가하기 위한 포괄적이고 도전적인 OCR 벤치마크". 이 데이터 세트는 다중 장면 텍스트 읽기, 다국어 텍스트 읽기, 문서 구문 분석, 핵심 정보 추출이라는 4가지 핵심 작업을 다루며, 39개 하위 세트와 7,058개의 완전히 주석이 달린 이미지를 포함합니다. CC-OCR의 출시는 복잡한 구조와 세밀한 시각적 과제에서 현재 멀티모달 모델을 평가하는 데 있어 부족한 부분을 채워주며, 실제 응용 분야에서 멀티모달 모델의 발전을 촉진하는 데 큰 의의가 있습니다.

소환

@misc{yang2024ccocr,
title={CC-OCR: A Comprehensive and Challenging OCR Benchmark for Evaluating Large Multimodal Models in Literacy},
author={Zhibo Yang and Jun Tang and Zhaohai Li and Pengfei Wang and Jianqiang Wan and Humen Zhong and Xuejing Liu and Mingkun Yang and Peng Wang and Shuai Bai and LianWen Jin and Junyang Lin},
year={2024},
eprint={2412.02210},
archivePrefix={arXiv},
primaryClass={cs.CV},
url={https://arxiv.org/abs/2412.02210},
}
CC-OCR.torrent
시딩 1다운로드 중 0완료됨 270총 다운로드 수 443
  • CC-OCR/
    • README.md
      1.52 KB
    • README.txt
      3.04 KB
      • data/
        • CC-OCR.zip
          1.49 GB

AI로 AI 구축

아이디어에서 출시까지 — 무료 AI 코코딩, 즉시 사용 가능한 환경, 최적의 GPU 가격으로 AI 개발을 가속화하세요.

AI 협업 코딩
바로 사용 가능한 GPU
최적의 가격

HyperAI Newsletters

최신 정보 구독하기
한국 시간 매주 월요일 오전 9시 에 이번 주의 최신 업데이트를 메일로 발송합니다
이메일 서비스 제공: MailChimp
CC-OCR 텍스트 인식 데이터 세트 | 데이터 세트 | HyperAI초신경