التاريخ

منذ 4 أعوام

الحجم

1.76 GB

المؤسسة

عنوان URL للنشر

ai.stanford.edu

رابط الورقة البحثية

arxiv.org

الترخيص

Other

الوسوم

فهم الصور

Visual7W عبارة عن مجموعة بيانات لفهم محتوى الصورة. إنه يقوم بأداء مهام الإجابة على الأسئلة البصرية من خلال وصف مناطق الصورة في النص وارتباطاتها. لا تحتوي مجموعة البيانات على الصورة نفسها فحسب، بل تحتوي أيضًا على أسئلة وأجوبة تتعلق بمحتوى منطقة الصورة. Visual7W عبارة عن مجموعة فرعية من مجموعة بيانات Visual Genome، تحتوي على 47,300 صورة لمجموعة بيانات COCO، و327,929 زوجًا من الأسئلة والأجوبة، و1,311,756 سؤالًا متعدد الاختيارات من صنع الإنسان، و561,459 أساسًا للأشياء تغطي 36,579 فئة. تتكون أسئلة Visual7W بشكل أساسي من ماذا، وأين، وكيف، ومتى، ومن، ولماذا، وأي. الأسئلة هي اختيارات متعددة وكل سؤال لديه أربعة إجابات محتملة.

Visual7W.torrent

البذر 2جارٍ التنزيل 0مكتمل 600إجمالي التنزيلات 750

Visual7W/
- README.md
  1.34 KB
- README.txt
  2.68 KB

تم المساهمة بهذه المجموعة من البيانات من قبل مستخدمي المجتمع وهي مخصصة للأغراض التعليمية والإعلامية فقط. إذا كان أي محتوى ينطوي على انتهاك لحقوق النشر، يرجى الاتصال بنا على [email protected] للمراجعة والإزالة الفورية.

مجموعات البيانات ذات الصلة

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.

البرمجة التعاونية باستخدام الذكاء الاصطناعي

وحدات GPU جاهزة للعمل

أفضل الأسعار

ابدأ عرض الأسعار