مجموعة بيانات معيارية للإجابة على أسئلة الفيديو الطويلة M3-Bench
M3-Bench عبارة عن مجموعة بيانات مرجعية طويلة للإجابة على أسئلة الفيديو أصدرها فريق ByteDance Seed في عام 2025. نتائج الورقة ذات الصلة هي "الرؤية والاستماع والتذكر والاستدلال: وكيل متعدد الوسائط ذو ذاكرة طويلة المدى"، والذي يهدف إلى تقييم الذاكرة طويلة المدى والقدرة على التفكير لدى الوكلاء الأذكياء متعددي الوسائط.
تحتوي مجموعة البيانات على 1020 عينة فيديو، تتضمن كل منها تعليقات توضيحية، ومخرجات وسيطة، وخرائط ذاكرة. يعتمد M3-Bench على الإجابة على أسئلة مفتوحة (VQA) عبر مقاطع فيديو طويلة كمهمة أساسية، حيث يُرفق بكل فيديو مجموعة من الأسئلة المفتوحة.
تكوين البيانات:
- روبوت M3-Bench-robot: 100 مقطع فيديو جديد من منظور الشخص الأول لسيناريوهات العالم الحقيقي (منظور الروبوت) سجلها فريق البحث
- M3-Bench-web: 920 مقطع فيديو طويلًا من الإنترنت، تغطي نطاقًا أوسع من المحتوى والسيناريوهات
بناء الذكاء الاصطناعي بالذكاء الاصطناعي
من الفكرة إلى الإطلاق — عجّل تطوير الذكاء الاصطناعي الخاص بك من خلال البرمجة المشتركة المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.
البرمجة المشتركة بالذكاء الاصطناعي
وحدات معالجة رسومات جاهزة
أفضل الأسعار
Hyper Newsletters
اشترك في آخر تحديثاتنا
سنرسل لك أحدث التحديثات الأسبوعية إلى بريدك الإلكتروني في الساعة التاسعة من صباح كل يوم اثنين
مدعوم بواسطة MailChimp