Command Palette
Search for a command to run...
مجموعة بيانات معيارية للإجابة على أسئلة الفيديو الطويلة M3-Bench
M3-Bench عبارة عن مجموعة بيانات مرجعية طويلة للإجابة على أسئلة الفيديو أصدرها فريق ByteDance Seed في عام 2025. نتائج الورقة ذات الصلة هي "الرؤية والاستماع والتذكر والاستدلال: وكيل متعدد الوسائط ذو ذاكرة طويلة المدى"، والذي يهدف إلى تقييم الذاكرة طويلة المدى والقدرة على التفكير لدى الوكلاء الأذكياء متعددي الوسائط.
تحتوي مجموعة البيانات على 1020 عينة فيديو، تتضمن كل منها تعليقات توضيحية، ومخرجات وسيطة، وخرائط ذاكرة. يعتمد M3-Bench على الإجابة على أسئلة مفتوحة (VQA) عبر مقاطع فيديو طويلة كمهمة أساسية، حيث يُرفق بكل فيديو مجموعة من الأسئلة المفتوحة.
تكوين البيانات:
- روبوت M3-Bench-robot: 100 مقطع فيديو جديد من منظور الشخص الأول لسيناريوهات العالم الحقيقي (منظور الروبوت) سجلها فريق البحث
- M3-Bench-web: 920 مقطع فيديو طويلًا من الإنترنت، تغطي نطاقًا أوسع من المحتوى والسيناريوهات
بناء الذكاء الاصطناعي بالذكاء الاصطناعي
من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.