LSVTD 视频文本理解数据集

该数据集暂无下载资源提供,我们正在积极的准备提供更多的数据集

LSVTD 全称 large-scale video text dataset,包含来自 21 个自然场景的 100 个视频。该数据集涵盖了广泛的 13 个室内(如书店、商场)和 9 个室外场景,其多样性是 IC15 数据集的 3 倍以上。