Command Palette
Search for a command to run...
MULTI-Benchmark: لوحة متصدرين للفهم المتعدد الوسائط مع النص والصور
التاريخ
الحجم
تعد مجموعة البيانات هذه بمثابة معيار متعدد الوسائط MULTI الذي أصدرته جامعة شنغهاي جياو تونغ، والذي يهدف إلى تقييم قدرة النماذج متعددة الوسائط الكبيرة على فهم الجداول والصور المعقدة وإجراء استنتاجات نصية طويلة. يوفر الاختبار مدخلات متعددة الوسائط ويتطلب أن تكون الإجابات دقيقة أو مفتوحة، مما يعكس أسلوب الاختبار في الحياة الواقعية. يحتوي MULTI على أكثر من 18000 سؤال، تغطي مجموعة متنوعة من المهام من اشتقاق الصيغة إلى تحليل الصور والتفكير المتقاطع. كما أنشأ فريق البحث MULTI-Elite، وهي مجموعة فرعية مختارة بعناية من الأسئلة الصعبة تحتوي على 500 مشكلة، وMULTI-Extend، وهي مجموعة بيانات تحتوي على أكثر من 4500 سياق معرفي خارجي. لا يعمل MULTI كمنصة تقييم قوية فحسب، بل يشير أيضًا إلى الطريق لتطوير الذكاء الاصطناعي على مستوى الخبراء.
الاستشهاد
@article{zhu2025multi, العنوان={{متعدد الوسائط}: لوحة الصدارة للفهم متعدد الوسائط مع النصوص والصور}, المؤلف={Zichen Zhu وYang Xu وLu Chen وJingkai Yang وYichuan Ma وYiming Sun وHailin Wen وJiaqi Liu وJinyu Cai وYingzi Ma وSituo Zhang وZihan Zhao وLiangtai Sun وKai Yu}, مجلة = "علوم المعلومات في الصين"، السنة = "2025"، مستوى الصوت = "68"، الرقم = "10"، الصفحات = "200107.1–200107.26"، doi = “https://doi.org/10.1007/s11432-024-4602-x” }
بناء الذكاء الاصطناعي بالذكاء الاصطناعي
من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.