中文

生成用于识别的文本序列图像

计算机视觉与模式识别 2022-05-06 v1

摘要

近年来,基于深度学习的方法在文本识别领域占据主导地位。在大量训练数据下,其中大多数方法都能达到最先进的性能。然而,从真实场景中获取并标注足够的文本序列图像十分困难。为缓解此问题,已有若干合成文本序列图像的方法被提出,但它们通常需要复杂的前置或后续步骤。本工作中,我们提出一种无需任何辅助预处理/后处理即可生成无限训练数据的方法。我们将生成任务视为图像到图像的翻译问题,并利用条件对抗网络根据语义图像生成逼真的文本序列图像。我们引入若干评估指标来评价所提方法,结果表明数据质量令人满意。代码与数据集将很快公开。

关键词

引用

@article{arxiv.1901.06782,
  title  = {Generating Text Sequence Images for Recognition},
  author = {Yanxiang Gong and Linjie Deng and Zheng Ma and Mei Xie},
  journal= {arXiv preprint arXiv:1901.06782},
  year   = {2022}
}