中文

Open Images V5 文本标注与另一种掩码文本 spotting 器

计算机视觉与模式识别 2021-06-24 v1

摘要

大规模人工标注数据集在创建高质量深度学习模型中起着重要作用。本文给出 Open Images V5 数据集的文本标注。据我们所知,它是公开可用的人工创建文本标注中规模最大的。利用该标注,我们训练了一个简单的基于 Mask-RCNN 的网络,称为 Yet Another Mask Text Spotter (YAMTS),其在 ICDAR2013、ICDAR2015 和 Total-Text 数据集上取得了有竞争力的性能,在某些情况下甚至优于当前最先进的方法。文本 spotting 模型的代码在线发布于:https://github.com/openvinotoolkit/training_extensions。该模型可导出为 OpenVINO 格式并在 Intel CPU 上运行。

关键词

引用

@article{arxiv.2106.12326,
  title  = {Open Images V5 Text Annotation and Yet Another Mask Text Spotter},
  author = {Ilya Krylov and Sergei Nosov and Vladislav Sovrasov},
  journal= {arXiv preprint arXiv:2106.12326},
  year   = {2021}
}