Question Answering On Muld Narrativeqa
المقاييس
BLEU-1
BLEU-4
METEOR
Rouge-L
النتائج
نتائج أداء النماذج المختلفة على هذا المعيار القياسي
جدول المقارنة
اسم النموذج | BLEU-1 | BLEU-4 | METEOR | Rouge-L |
---|---|---|---|---|
muld-the-multitask-long-document-benchmark | 19.84 | 62 | 4.52 | 22.09 |
muld-the-multitask-long-document-benchmark | 17.67 | 55 | 3.36 | 19.03 |