European Parliament Proceedings Parallel Corpus 1996-2011 统计机器翻译语料库

.torrent 种子下载(推荐) 磁力链 下载遇到问题?

European Parliament Proceedings Parallel Corpus 1996-2011 数据集是一个统计机器翻译语料库。Europarl 平行语料库是从欧洲议会的程序中提取的, 它包括 21 种欧洲语言版本:

  • 罗马语(法语,意大利语,西班牙语,葡萄牙语,罗马尼亚语)
  • 日耳曼语(英语,荷兰语,德语,丹麦语,瑞典语)
  • Slavik(保加利亚语,捷克语,波兰语,斯洛伐克语,斯洛文尼亚语)
  • Finni-Ugric(芬兰语,匈牙利语,爱沙尼亚语)
  • 波罗的海语(拉脱维亚语,立陶宛语)
  • 希腊语

European Parliament Proceedings Parallel Corpus 1996-2011 数据集最初于 2005 年由苏格兰爱丁堡大学信息学院发布,主要发布人为 Philipp Koehn,后于 2012 年发布第 7 版,相关论文为 Europarl: A Parallel Corpus for Statistical Machine Translation。

文件名大小
README.md1.55 KB
README.txt1.55 KB
bg-en.tgz40.61 MB
cs-en.tgz59.19 MB
da-en.tgz179 MB
de-en.tgz188.62 MB
el-en.tgz144.38 MB
es-en.tgz186.03 MB
et-en.tgz56.6 MB
europarl.tgz1.46 GB
fi-en.tgz178.16 MB
fr-en.tgz193.33 MB
hu-en.tgz58.5 MB
it-en.tgz187.61 MB
lt-en.tgz56.01 MB
lv-en.tgz56.28 MB
nl-en.tgz189.86 MB
pl-en.tgz58.84 MB
pt-en.tgz188.58 MB
ro-en.tgz36.41 MB
sk-en.tgz58.51 MB
sl-en.tgz53.97 MB
sv-en.tgz170.33 MB

抱歉,暂无相关内容推荐。