HyperAIHyperAI

Command Palette

Search for a command to run...

MMPR-Datensatz Für Multimodale Schlussfolgerungspräferenzen

Datum

vor 2 Jahren

Größe

29.29 GB

Organisation

Nanjing University
Fudan University
The Shanghai AI Laboratory

Veröffentlichungs-URL

github.com

Paper-URL

arxiv.org

MMPR (Multimodal Preference Dataset) ist ein umfangreicher multimodaler Präferenzdatensatz, der 2024 gemeinsam von den Forschungsteams des Shanghai Artificial Intelligence Laboratory, der Fudan University, der Nanjing University, der Chinese University of Hong Kong, der Tsinghua University und SenseTime veröffentlicht wurde. Die entsprechenden Ergebnisse der Studie sind „Verbesserung der Argumentationsfähigkeit multimodaler großer Sprachmodelle durch gemischte PräferenzoptimierungDer Datensatz enthält 750.000 Beispiele ohne eindeutige richtige Antworten und 2,5 Millionen Beispiele mit eindeutigen richtigen Antworten. Die Beispiele decken mehrere Bereiche ab, wie z. B. VQA, Naturwissenschaften, Grafik, Mathematik, OCR und Dokumente, um Vielfalt zu gewährleisten. Bei der Erstellung des Datensatzes achteten die Forscher besonders darauf, falsch positive und negative Antworten aufgrund der Einschränkungen heuristischer Regeln zu vermeiden, insbesondere in den allgemeinen VQA- und Dokumentdomänen. Der Datensatz wurde entwickelt, um die Leistung des Modells bei multimodalen Denkaufgaben zu verbessern und gleichzeitig potenzielle negative Effekte während des Trainings zu vermeiden.

Beispiel für Daten von MMPR. Für Anweisungen mit eindeutigen richtigen Antworten schlug das Forschungsteam einen auf Richtigkeit basierenden Prozess vor, der mehrere Lösungen auswählt und diejenigen mit richtigen Antworten als Auswahlantworten und diejenigen mit falschen Antworten als Ablehnungsantworten behandelt. Für Befehle, für die es keine eindeutige richtige Antwort gibt, schlug das Forschungsteam vor, DropoutNTP zu verwenden, um eine Ablehnungsantwort zu generieren. Die Unterschiede zwischen den Auswahl- und Ablehnungsantworten werden durch Kursivschrift hervorgehoben. Rote Markierungen zeigen falsche Antworten an.
Beispiel für Daten von MMPR. Für Anweisungen mit eindeutigen richtigen Antworten schlug das Forschungsteam einen auf Richtigkeit basierenden Prozess vor, der mehrere Lösungen auswählt und diejenigen mit richtigen Antworten als Auswahlantworten und diejenigen mit falschen Antworten als Ablehnungsantworten behandelt. Für Befehle, für die es keine eindeutige richtige Antwort gibt, schlug das Forschungsteam vor, DropoutNTP zu verwenden, um eine Ablehnungsantwort zu generieren. Die Unterschiede zwischen den Auswahl- und Ablehnungsantworten werden durch Kursivschrift hervorgehoben. Rote Markierungen zeigen falsche Antworten an.

Zitat

Falls Ihnen dieses Projekt für Ihre Forschung nützlich ist, erwägen Sie bitte, es zu zitieren: „`BibTeX @article{wang2024mpo, title={Verbesserung der Argumentationsfähigkeit multimodaler großer Sprachmodelle durch Optimierung gemischter Präferenzen}, Autor={Wang, Weiyun und Chen, Zhe und Wang, Wenhai und Cao, Yue und Liu, Yangzhou und Gao, Zhangwei und Zhu, Jinguo und Zhu, Xizhou und Lu, Lewei und Qiao, Yu und Dai, Jifeng} journal={arXiv preprint arXiv:2411.10442}, Jahr={2024} } @article{chen2023internvl, title={InternVL: Skalierung von Vision Foundation-Modellen und Ausrichtung für generische visuell-linguistische Aufgaben}, Autor={Chen, Zhe und Wu, Jiannan und Wang, Wenhai und Su, Weijie und Chen, Guo und Xing, Sen und Zhong, Muyan und Zhang, Qinglong und Zhu, Xizhou und Lu, Lewei und Li, Bin und Luo, Ping und Lu, Tong und Qiao, Yu und Dai, Jifeng} journal={arXiv preprint arXiv:2312.14238}, Jahr={2023} } @article{chen2024far, title={Wie weit sind wir von GPT-4V entfernt? Die Lücke zu kommerziellen multimodalen Modellen mit Open-Source-Suiten schließen}, Autoren: {Chen, Zhe und Wang, Weiyun und Tian, Hao und Ye, Shenglong und Gao, Zhangwei und Cui, Erfei und Tong, Wenwen und Hu, Kongzhi und Luo, Jiapeng und Ma, Zheng und andere} journal={arXiv preprint arXiv:2404.16821}, Jahr={2024} }

MMPR-OpenGVLab.torrent
Seeding 1Wird heruntergeladen 0Abgeschlossen 200Downloads insgesamt 264
  • MMPR-OpenGVLab/
    • README.md
      2.12 KB
    • README.txt
      4.25 KB
      • data/
        • MMPR.zip
          14.63 GB
          • MMPR/
            • README.md
              14.63 GB
            • meta.json
              29.29 GB
            • images.zip
              29.29 GB
            • annotations.zip
              16.03 GB

KI mit KI entwickeln

Von der Idee bis zum Launch – beschleunigen Sie Ihre KI-Entwicklung mit kostenlosem KI-Co-Coding, sofort einsatzbereiter Umgebung und bestem GPU-Preis.

KI-gestütztes kollaboratives Programmieren
Sofort einsatzbereite GPUs
Die besten Preise

HyperAI Newsletters

Abonnieren Sie unsere neuesten Updates
Wir werden die neuesten Updates der Woche in Ihren Posteingang liefern um neun Uhr jeden Montagmorgen
Unterstützt von MailChimp
MMPR-Datensatz Für Multimodale Schlussfolgerungspräferenzen | Datensätze | HyperAI