ICDAR 2019 招牌中文文本鲁棒阅读挑战赛
计算机视觉与模式识别
2019-12-23 v1
摘要
中文场景文本阅读是计算机视觉中最具挑战性的问题之一,并引起了广泛关注。与英文文本不同,中文有六千多个常用字符,且汉字可排布于多种版式并拥有海量字体。街景中的中文招牌是中文场景文本图像的理想来源,因其具有各异的背景、字体与版式。我们组织了一项名为 ICDAR2019-ReCTS 的竞赛,主要关注招牌上的中文文本阅读。本报告给出该竞赛的最终结果。我们发布了一个包含 25,000 张标注招牌图像的大规模数据集,其中所有文本行与字符均标注了位置与转写内容。设置了四项任务,分别为字符识别、文本行识别、文本行检测与端到端识别。此外,考虑到中文文本歧义问题,我们提出了一种多真值(multi-GT)评估方法以使评估更为公平。竞赛于 2019 年 3 月 1 日开始,2019 年 4 月 30 日结束。共收到来自 46 支队伍的 262 份提交。大多数参与者来自中国的高校、研究所与科技公司,也有部分参与者来自美国、澳大利亚、新加坡与韩国。21 支队伍提交了任务 1 的结果,23 支队伍提交了任务 2 的结果,24 支队伍提交了任务 3 的结果,13 支队伍提交了任务 4 的结果。竞赛官方网站为 http://rrc.cvc.uab.es/?ch=12。
引用
@article{arxiv.1912.09641,
title = {ICDAR 2019 Robust Reading Challenge on Reading Chinese Text on Signboard},
author = {Xi Liu and Rui Zhang and Yongsheng Zhou and Qianyi Jiang and Qi Song and Nan Li and Kai Zhou and Lei Wang and Dong Wang and Minghui Liao and Mingkun Yang and Xiang Bai and Baoguang Shi and Dimosthenis Karatzas and Shijian Lu and C. V. Jawahar},
journal= {arXiv preprint arXiv:1912.09641},
year = {2019}
}
备注
International Conference on Document Analysis and Recognition, 2019