泰卢固语光学字符识别(OCR):数据库、算法与应用
计算机视觉与模式识别
2018-12-27 v2
摘要
泰卢固语是一种德拉威语,全球有超过 8000 万人使用。泰卢固文字的光学字符识别(OCR)具有广泛用途,包括教育、医疗、行政等。然而优美的泰卢固文字与英语、德语等日耳曼文字差异很大。这使得将日耳曼语 OCR 方案通过迁移学习用于泰卢固语成为一项非平凡任务。为应对泰卢固语 OCR 的挑战,我们在本工作中做出三项贡献:(i)泰卢固字符数据库,(ii)基于深度学习的 OCR 算法,以及(iii)用于算法在线部署的客户端-服务器方案。为惠及泰卢固语使用者与研究群体,我们将在 https://gayamtrishal.github.io/OCR_Telugu.github.io/ 免费公开我们的代码。
引用
@article{arxiv.1711.07245,
title = {Optical Character Recognition (OCR) for Telugu: Database, Algorithm and Application},
author = {Chandra Prakash Konkimalla and Manikanta Srikar Yellapragada and Trishal Gayam and Souraj Mandal and Sumohana S. Channappayya},
journal= {arXiv preprint arXiv:1711.07245},
year = {2018}
}
备注
Accepted to IEEE International Conference on Image Processing 2018