HyperAI
Command Palette
Search for a command to run...
ApolloCorpora の多言語医療データセット
ApolloCorpora は、深センビッグデータ研究所と香港中文大学の研究チームが共同で構築した多言語医療データセットです。このデータセットは、英語、中国語、ヒンディー語、スペイン語、フランス語、アラビア語を含む、世界 61 億人が話す 6 つの主要言語をカバーしています。 データ収集には、書籍、臨床ガイドライン、百科事典、論文、フォーラム、試験が含まれます。データ処理の観点から、研究者らは元のトレーニング前コーパスを質問と回答のペアに変換して、モデルの医療機能を強化しました。 ApolloCorpora は、異なる文化や医療システムに適応するために、症状の診断、薬剤名、コミュニケーション用語、医療行為の基準などのローカライズされた機能にも重点を置いています。このデータセットは、多言語医療 AI モデルの開発と評価のための強固な基盤を提供し、医療 AI テクノロジーの世界的な適用の促進に役立ちます。
引用
@misc{wang2024apollo,
title={Apollo: Lightweight Multilingual Medical LLMs towards Democratizing Medical AI to 6B People},
author={Xidong Wang and Nuo Chen and Junyin Chen and Yan Hu and Yidong Wang and Xiangbo Wu and Anningzhe Gao and Xiang Wan and Haizhou Li and Benyou Wang},
year={2024},
eprint={2403.03640},
archivePrefix={arXiv},
primaryClass={cs.CL}
}
ApolloCorpus.torrent
シード中 1ダウンロード中 0完了 264総ダウンロード数 343
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。