HyperAI
Command Palette
Search for a command to run...
NLPCC2016 ニュース データセット
NLPCC2016 データセットは一般的なニュース データセットとは異なり、新浪微博のより非公式なテキストを使用しています。トレーニング データとテスト データは、金融、スポーツ、エンターテイメントなど、さまざまなトピックのマイクロブログで構成されています。このデータ セットは utf-8 でエンコードされており、中国語の単語の分割タスクに使用できます。
引用
@InProceedings{qiu2016overview,
Title = {Overview of the {NLPCC-ICCPOL} 2016 Shared Task: Chinese Word Segmentation for Micro-blog Texts},
Author = {Xipeng Qiu and Peng Qian and Zhan Shi},
Booktitle = {Proceedings of The Fifth Conference on Natural Language Processing and Chinese Computing \& The Twenty Fourth
International Conference on Computer Processing of Oriental Languages},
Year = {2016}
}
NLPCC2016.torrent
シード中 1ダウンロード中 0完了 1,174総ダウンロード数 2,515
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。