HyperAIHyperAI

Command Palette

Search for a command to run...

مجموعة بيانات معيارية لترجمة الفيديو التلقائية

ناقش على Discord

التاريخ

منذ 7 أشهر

رابط الورقة البحثية

arxiv.org

الترخيص

Apache 2.0

مجموعة بيانات AutoCaption هي مجموعة بيانات مرجعية لتعليقات الفيديو أصدرها مختبر Tjunlp في عام 2025. نتائج الورقة البحثية ذات الصلة هي "تقييم نماذج اللغة الكبيرة متعددة الوسائط في ترجمة الفيديو عبر بحث شجرة مونت كارلو"، والذي يهدف إلى تعزيز البحث في نماذج اللغة الكبيرة متعددة الوسائط في مجال إنشاء ترجمة الفيديو.

هيكل مجموعة البيانات:

تحتوي مجموعة البيانات على مجموعتين فرعيتين، بإجمالي 11,184 عينة:

  • sft_data: ضبط دقيق مُشرف لنماذج الترجمة (9,419 عينة لبيانات الضبط الدقيق المُشرف)
  • mcts_vcb: تم التقييم باستخدام التعليقات التوضيحية والنقاط الرئيسية التي تم إنشاؤها بواسطة MCTS (1765 عينة لتقييم معيار MCTS-VCB)

بناء الذكاء الاصطناعي بالذكاء الاصطناعي

من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.

البرمجة التعاونية باستخدام الذكاء الاصطناعي
وحدات GPU جاهزة للعمل
أفضل الأسعار

HyperAI Newsletters

اشترك في آخر تحديثاتنا
سنرسل لك أحدث التحديثات الأسبوعية إلى بريدك الإلكتروني في الساعة التاسعة من صباح كل يوم اثنين
مدعوم بواسطة MailChimp