中文

泰卢固语光学字符识别(OCR):数据库、算法与应用

计算机视觉与模式识别 2018-12-27 v2

摘要

泰卢固语是一种德拉威语,全球有超过 8000 万人使用。泰卢固文字的光学字符识别(OCR)具有广泛用途,包括教育、医疗、行政等。然而优美的泰卢固文字与英语、德语等日耳曼文字差异很大。这使得将日耳曼语 OCR 方案通过迁移学习用于泰卢固语成为一项非平凡任务。为应对泰卢固语 OCR 的挑战,我们在本工作中做出三项贡献:(i)泰卢固字符数据库,(ii)基于深度学习的 OCR 算法,以及(iii)用于算法在线部署的客户端-服务器方案。为惠及泰卢固语使用者与研究群体,我们将在 https://gayamtrishal.github.io/OCR_Telugu.github.io/ 免费公开我们的代码。

关键词

引用

@article{arxiv.1711.07245,
  title  = {Optical Character Recognition (OCR) for Telugu: Database, Algorithm and Application},
  author = {Chandra Prakash Konkimalla and Manikanta Srikar Yellapragada and Trishal Gayam and Souraj Mandal and Sumohana S. Channappayya},
  journal= {arXiv preprint arXiv:1711.07245},
  year   = {2018}
}

备注

Accepted to IEEE International Conference on Image Processing 2018