中文

ICDAR 2021 场景视频文本 spotting 竞赛

计算机视觉与模式识别 2021-07-27 v1

摘要

场景视频文本 spotting(SVTS)因诸多现实应用而成为一个非常重要的研究课题。然而,与对静态图像中场景文本 spotting 的大量研究相比,针对场景视频文本 spotting 的努力甚少。由于运动模糊等多种环境干扰,场景视频文本 spotting 变得极具挑战性。为推进该研究领域,本竞赛引入了一个包含来自 21 种自然场景的 129 个视频片段且带完整标注的新挑战数据集。竞赛包含三项任务,即视频文本检测(任务 1)、视频文本跟踪(任务 2)和端到端视频文本 spotting(任务 3)。在竞赛期间(2021 年 3 月 1 日开启,2021 年 4 月 11 日关闭),共有 24 支队伍参与了三项提议的任务,分别提交了 46 份有效结果。本文包含 ICDAR 2021 SVTS 竞赛的数据集描述、任务定义、评估协议与结果总结。得益于健康的队伍与提交数量,我们认为 SVTS 竞赛已成功举办,引起了社区的广泛关注并推动了领域研究及其发展。

关键词

引用

@article{arxiv.2107.11919,
  title  = {ICDAR 2021 Competition on Scene Video Text Spotting},
  author = {Zhanzhan Cheng and Jing Lu and Baorui Zou and Shuigeng Zhou and Fei Wu},
  journal= {arXiv preprint arXiv:2107.11919},
  year   = {2021}
}

备注

SVTS Technique Report for ICDAR 2021 competition