中文

Baybayin 字符实例检测

计算机视觉与模式识别 2023-04-20 v1

摘要

菲律宾政府最近通过了《国家书写系统法案》,提倡在菲律宾文本中使用 Baybayin。为支持这一推广 Baybayin 使用的举措,我们提出了一种计算机视觉系统,可帮助不易阅读 Baybayin 文字的人士。本文中,我们调研了现有利用计算机视觉与机器学习技术识别 Baybayin 文字的方法,并讨论其能力与局限。此外,我们提出了一种基于最先进卷积神经网络(CNNs)的 Baybayin 光学字符实例分割与分类模型,该模型检测图像中的 Baybayin 字符实例,并输出图像中每个字符实例对应的拉丁字母。大多数现有系统局限于字符级图像分类,且常对带附加符号的字符误分类或不原生支持。此外,这些现有模型常有特定输入要求,使其仅限于在受控环境下对 Baybayin 文本分类,例如在清晰度和对比度等方面的限制。据我们所知,我们提出的方法是首个端到端的 Baybayin 字符实例检测模型,取得了 93.30% 的 mAP50 分数、80.50% 的 mAP50-95 分数以及 84.84% 的 F1 分数。

关键词

引用

@article{arxiv.2304.09469,
  title  = {Baybayin Character Instance Detection},
  author = {Adriel Isaiah V. Amoguis and Gian Joseph B. Madrid and Benito Miguel D. Flores and Macario O. Cordel},
  journal= {arXiv preprint arXiv:2304.09469},
  year   = {2023}
}