ICDAR 2021 场景视频文本 spotting 竞赛
计算机视觉与模式识别
2021-07-27 v1
摘要
场景视频文本 spotting(SVTS)因诸多现实应用而成为一个非常重要的研究课题。然而,与对静态图像中场景文本 spotting 的大量研究相比,针对场景视频文本 spotting 的努力甚少。由于运动模糊等多种环境干扰,场景视频文本 spotting 变得极具挑战性。为推进该研究领域,本竞赛引入了一个包含来自 21 种自然场景的 129 个视频片段且带完整标注的新挑战数据集。竞赛包含三项任务,即视频文本检测(任务 1)、视频文本跟踪(任务 2)和端到端视频文本 spotting(任务 3)。在竞赛期间(2021 年 3 月 1 日开启,2021 年 4 月 11 日关闭),共有 24 支队伍参与了三项提议的任务,分别提交了 46 份有效结果。本文包含 ICDAR 2021 SVTS 竞赛的数据集描述、任务定义、评估协议与结果总结。得益于健康的队伍与提交数量,我们认为 SVTS 竞赛已成功举办,引起了社区的广泛关注并推动了领域研究及其发展。
引用
@article{arxiv.2107.11919,
title = {ICDAR 2021 Competition on Scene Video Text Spotting},
author = {Zhanzhan Cheng and Jing Lu and Baorui Zou and Shuigeng Zhou and Fei Wu},
journal= {arXiv preprint arXiv:2107.11919},
year = {2021}
}
备注
SVTS Technique Report for ICDAR 2021 competition