中文

一种用于高精度印刷孟加拉语OCR系统的BLSTM网络

计算机视觉与模式识别 2019-08-26 v1 计算与语言 机器学习

摘要

本文介绍了一种由我们开发的印刷孟加拉语和英语文本OCR系统,该系统使用具有128个单元的单一隐藏层BLSTM-CTC架构。在此架构中,我们没有使用任何窥孔连接和dropout,这有助于我们获得更高的精度。该架构使用包含英语单词的47,720行文本进行训练。在20种不同孟加拉字体上测试时,其字符级精度达到99.32%,单词级精度达到96.65%。Google也开发了一个良好的Indic多文种OCR系统。该系统有时会将孟加拉语字符识别为非孟加拉语文字(尤其是阿萨姆语)中的相同字符,而阿萨姆语除少数字符外与孟加拉语没有区别。例如,孟加拉语字符'RA'有时被识别为阿萨姆语的对应字符,主要出现在复合辅音形式中。我们的OCR系统没有此类错误。该OCR系统可在https://banglaocr.nltr.org在线获取。

关键词

引用

@article{arxiv.1908.08674,
  title  = {A BLSTM Network for Printed Bengali OCR System with High Accuracy},
  author = {Debabrata Paul and Bidyut Baran Chaudhuri},
  journal= {arXiv preprint arXiv:1908.08674},
  year   = {2019}
}

备注

6 pages, 6 figures, This OCR system is available online at https://banglaocr.nltr.org