LSVTD 视频文本理解数据集

日期

2 年前

机构

Zhejiang University

许可协议

其他

下载帮助
特色图像

LSVTD 全称 large-scale video text dataset,包含来自 21 个自然场景的 100 个视频。该数据集涵盖了广泛的 13 个室内(如书店、商场)和 9 个室外场景,其多样性是 IC15 数据集的 3 倍以上。