HyperAIHyperAI

Command Palette

Search for a command to run...

مجموعة بيانات الحوسبة الطبية MedCalc-Bench

التاريخ

منذ 2 أعوام

الحجم

16.04 MB

المؤسسة

NIH

عنوان URL للنشر

github.com

رابط الورقة البحثية

arxiv.org

MedCalc-Bench عبارة عن مجموعة بيانات مصممة خصيصًا لتقييم قدرات الحوسبة الطبية للنماذج اللغوية الكبيرة (LLMs). تم إصداره بشكل مشترك في عام 2024 من قبل تسع مؤسسات بما في ذلك المكتبة الوطنية للطب والمعاهد الوطنية للصحة وجامعة فيرجينيا. "نتائج الورقة ذات الصلة هي"MEDCALC-BENCH: تقييم نماذج اللغة الكبيرة للحسابات الطبية"، تم قبولها بواسطة NeurIPS 2024. تحتوي مجموعة البيانات هذه على 10,055 حالة تدريب و1,047 حالة اختبار، تغطي 55 مهمة حسابية مختلفة. يتضمن كل مثال ملاحظات المريض، وسؤالاً لحساب قيمة سريرية محددة، وقيمة الإجابة النهائية، وحلاً خطوة بخطوة. يهدف برنامج MedCalc-Bench إلى تحسين مهارات التفكير اللفظي والحسابي لحاملي شهادة الماجستير في القانون في البيئة الطبية. تتضمن ميزات مجموعة البيانات رقم الصف، ومعرف الآلة الحاسبة، واسم الآلة الحاسبة، والفئة، ونوع الإخراج، ومعرف الملاحظة، ونوع الملاحظة، وملاحظة المريض، والسؤال، والكيان ذي الصلة، وإجابة الحقيقة الأساسية، والحد الأدنى، والحد الأعلى، وشرح الحقيقة الأساسية. توفر هذه الميزات للنموذج معلومات سياقية غنية للحساب والاستدلال الدقيق. تنقسم مجموعة البيانات إلى مجموعات تدريب واختبار، والتي يمكن استخدامها لضبط برامج LLM لتحسين أدائها في مهام الحوسبة الطبية.

الاستشهاد

@misc{khandekar2024medcalcbench,
title={MedCalc-Bench: Evaluating Large Language Models for Medical Calculations},
author={Nikhil Khandekar and Qiao Jin and Guangzhi Xiong and Soren Dunn and Serina S Applebaum and Zain Anwar and Maame Sarfo-Gyamfi and Conrad W Safranek and Abid A Anwar and Andrew Zhang and Aidan Gilson and Maxwell B Singer and Amisha Dave and Andrew Taylor and Aidong Zhang and Qingyu Chen and Zhiyong Lu},
year={2024},
eprint={2406.12036},
archivePrefix={arXiv},
primaryClass={id='cs.CL' full_name='Computation and Language' is_active=True alt_name='cmp-lg' in_archive='cs' is_general=False description='Covers natural language processing. Roughly includes material in ACM Subject Class I.2.7. Note that work on artificial languages (programming languages, logics, formal systems) that does not explicitly address natural-language issues broadly construed (natural-language processing, computational linguistics, speech, text retrieval, etc.) is not appropriate for this area.'}
}
MedCalc-Bench.torrent
توزيع 1جاري التنزيل 0مكتمل 247إجمالي التنزيلات 498
  • MedCalc-Bench/
    • README.md
      1.94 KB
    • README.txt
      3.88 KB
      • data/
        • bench.zip
          16.04 MB

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.

البرمجة التعاونية باستخدام الذكاء الاصطناعي
وحدات GPU جاهزة للعمل
أفضل الأسعار

HyperAI Newsletters

اشترك في آخر تحديثاتنا
سنرسل لك أحدث التحديثات الأسبوعية إلى بريدك الإلكتروني في الساعة التاسعة من صباح كل يوم اثنين
مدعوم بواسطة MailChimp
مجموعة بيانات الحوسبة الطبية MedCalc-Bench | مجموعات بيانات | HyperAI