HyperAIHyperAI

Command Palette

Search for a command to run...

DISC-Law-SFT Hochwertiger Feinabstimmungsdatensatz Zur Chinesischen Rechtsaufsicht

Datum

vor 2 Jahren

Größe

80.22 MB

Organisation

复旦大学

Veröffentlichungs-URL

github.com

Paper-URL

arxiv.org

* Dieser Datensatz unterstützt die Online-Nutzung.Klicken Sie hier, um zu springen.

Der DISC-Law-SFT-Datensatz ist ein hochwertiger, überwachter Feinabstimmungsdatensatz (SFT), der 2023 vom Data Intelligence and Social Computing Laboratory der Fudan University (Fudan-DISC) erstellt wurde. Er wird zum Trainieren und Verbessern der Anwendungsfähigkeiten großer Sprachmodelle (LLMs) im Rechtsbereich verwendet und enthält fast 300.000 Trainingsdaten. Dieser Datensatz wurde speziell für den chinesischen Rechtsbereich entwickelt und zielt darauf ab, die Fähigkeiten des Modells bei der Verarbeitung juristischer Texte, beim juristischen Denken sowie bei der Wissensabfrage und -einhaltung im Rechtsbereich zu verbessern. Das entsprechende Papier istDISC-LawLLM: Feinabstimmung großer Sprachmodelle für intelligente Rechtsdienstleistungen" Der Datensatz enthält zwei Teilmengen: DISC-Law-SFT-Pair und DISC-Law-SFT-Triplet. Die Teilmenge DISC-Law-SFT-Pair führt juristische Argumentationsfähigkeiten durch die Methode der Anweisungspaarkonstruktion des juristischen Syllogismus ein, während die Teilmenge DISC-Law-SFT-Triplett die Fähigkeit des Modells verbessert, externes Wissen zu nutzen, indem sie Tripel konstruiert, die Eingabe-, Ausgabe- und Referenzinformationen enthalten. Die Datenquellen des Datensatzes umfassen hauptsächlich drei Teile: öffentliche Datensätze zu NLP-Rechtsaufgaben im Zusammenhang mit chinesischem Recht, Originalrechtstexte aus der realen Welt und allgemeine Open-Source-Datensätze. Solche Datenquellen gewährleisten die Vielfalt und Reichhaltigkeit des Datensatzes.

Zitat

@misc{yue2023disclawllm, title={DISC-LawLLM: Feinabstimmung großer Sprachmodelle für intelligente Rechtsdienstleistungen}, Autor={Shengbin Yue und Wei Chen und Siyuan Wang und Bingxuan Li und Chenchen Shen und Shujun Liu und Yuxuan Zhou und Yao Xiao und Song Yun und Xuanjing Huang und Zhongyu Wei}, Jahr={2023}, eprint={2309.11325}, archivePrefix={arXiv}, primaryClass={cs.CL} } @inproceedings{yue2024lawllm, title={LawLLM: Intelligentes Rechtssystem mit juristischer Argumentation und verifizierbarer Abfrage}, Autor={Yue, Shengbin und Liu, Shujun und Zhou, Yuxuan und Shen, Chenchen und Wang, Siyuan und Xiao, Yao und Li, Bingxuan und Song, Yun und Shen, Xiaoyu und Chen, Wei und andere} Buchtitel={Internationale Konferenz über Datenbanksysteme für fortgeschrittene Anwendungen}, Seiten={304–321}, Jahr={2024}, Organisation={Springer} }

DISC-Law-SFT.torrent
Seeding 1Downloading 0Completed 321Total Downloads 857
  • DISC-Law-SFT/
    • README.md
      1.88 KB
    • README.txt
      3.77 KB
      • data/
        • DISC-Law-SFT.zip
          80.22 MB

KI mit KI entwickeln

Von der Idee bis zum Launch – beschleunigen Sie Ihre KI-Entwicklung mit kostenlosem KI-Co-Coding, sofort einsatzbereiter Umgebung und bestem GPU-Preis.

KI-gestütztes kollaboratives Programmieren
Sofort einsatzbereite GPUs
Die besten Preise

HyperAI Newsletters

Abonnieren Sie unsere neuesten Updates
Wir werden die neuesten Updates der Woche in Ihren Posteingang liefern um neun Uhr jeden Montagmorgen
Unterstützt von MailChimp
DISC-Law-SFT Hochwertiger Feinabstimmungsdatensatz Zur Chinesischen Rechtsaufsicht | Datensätze | HyperAI