HyperAI
Command Palette
Search for a command to run...
ApolloCorpora 다국어 의료 데이터 세트
ApolloCorpora는 선전 빅데이터 연구소와 홍콩 중국 대학 연구팀이 공동으로 구축한 다국어 의료 데이터 세트입니다. 이 데이터 세트는 영어, 중국어, 힌디어, 스페인어, 프랑스어, 아랍어를 포함하여 전 세계 61억 명이 사용하는 6개 주요 언어를 다룹니다. 데이터 수집에는 서적, 임상 지침, 백과사전, 논문, 포럼, 시험 등이 포함되었습니다. 데이터 처리 측면에서 연구진은 모델의 의학적 역량을 강화하기 위해 원래의 사전 훈련 코퍼스를 질문-답변 쌍으로 변환했습니다. ApolloCorpora는 또한 다양한 문화와 의료 시스템에 적응하기 위해 증상 진단, 약물 이름, 커뮤니케이션 용어, 의료 관행 표준과 같은 지역화된 기능에 중점을 둡니다. 이 데이터 세트는 다국어 의료 AI 모델의 개발 및 평가를 위한 견고한 기반을 제공하며, 의료 AI 기술의 글로벌 적용을 촉진하는 데 도움이 됩니다.
소환
@misc{wang2024apollo,
title={Apollo: Lightweight Multilingual Medical LLMs towards Democratizing Medical AI to 6B People},
author={Xidong Wang and Nuo Chen and Junyin Chen and Yan Hu and Yidong Wang and Xiangbo Wu and Anningzhe Gao and Xiang Wan and Haizhou Li and Benyou Wang},
year={2024},
eprint={2403.03640},
archivePrefix={arXiv},
primaryClass={cs.CL}
}
ApolloCorpus.torrent
시딩 중 1다운로드 중 0완료됨 264총 다운로드 343
이 데이터셋은 커뮤니티 사용자가 기여한 것이며 교육 및 정보 제공 목적으로만 사용됩니다. 저작권 침해와 관련된 콘텐츠가 있는 경우 [email protected]로 문의하시면 신속하게 검토 및 삭제 처리하겠습니다.