HyperAIHyperAI

Command Palette

Search for a command to run...

مجموعة بيانات معيارية للإجابة على أسئلة الفيديو الطويلة M3-Bench

التاريخ

منذ 6 أشهر

المؤسسة

بذرة بايت دانس

رابط الورقة البحثية

2508.09736

الترخيص

Non-Commercial

M3-Bench عبارة عن مجموعة بيانات مرجعية طويلة للإجابة على أسئلة الفيديو أصدرها فريق ByteDance Seed في عام 2025. نتائج الورقة ذات الصلة هي "الرؤية والاستماع والتذكر والاستدلال: وكيل متعدد الوسائط ذو ذاكرة طويلة المدى"، والذي يهدف إلى تقييم الذاكرة طويلة المدى والقدرة على التفكير لدى الوكلاء الأذكياء متعددي الوسائط.

تحتوي مجموعة البيانات على 1020 عينة فيديو، تتضمن كل منها تعليقات توضيحية، ومخرجات وسيطة، وخرائط ذاكرة. يعتمد M3-Bench على الإجابة على أسئلة مفتوحة (VQA) عبر مقاطع فيديو طويلة كمهمة أساسية، حيث يُرفق بكل فيديو مجموعة من الأسئلة المفتوحة.

تكوين البيانات:

  • روبوت M3-Bench-robot: 100 مقطع فيديو جديد من منظور الشخص الأول لسيناريوهات العالم الحقيقي (منظور الروبوت) سجلها فريق البحث
  • M3-Bench-web: 920 مقطع فيديو طويلًا من الإنترنت، تغطي نطاقًا أوسع من المحتوى والسيناريوهات

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.

البرمجة التعاونية باستخدام الذكاء الاصطناعي
وحدات GPU جاهزة للعمل
أفضل الأسعار

HyperAI Newsletters

اشترك في آخر تحديثاتنا
سنرسل لك أحدث التحديثات الأسبوعية إلى بريدك الإلكتروني في الساعة التاسعة من صباح كل يوم اثنين
مدعوم بواسطة MailChimp