中文

基于全归一化的场景文本识别

计算机视觉与模式识别 2021-09-03 v1

摘要

场景文本识别近年来取得了显著进展,并成为工作流程的重要组成部分。移动设备的广泛使用为在日常生活中使用 OCR 技术开辟了广阔可能。然而,该领域缺乏用于新研究的训练数据仍是一个现实问题。在本文中,我们提出了一个由智能手机真实拍摄组成的新数据集,并展示了轮廓归一化在此任务中的有效性。此外,详细研究了在智能手机文档图像分析模型训练期间各种数据增强的影响。我们的数据集已公开可用。

关键词

引用

@article{arxiv.2109.01034,
  title  = {Scene Text recognition with Full Normalization},
  author = {Nathan Zachary and Gerald Carl and Russell Elijah and Hessi Roma and Robert Leer and James Amelia},
  journal= {arXiv preprint arXiv:2109.01034},
  year   = {2021}
}

备注

arXiv admin note: text overlap with arXiv:1907.09653 by other authors