视频序列中的孟加拉语文本识别:一个新焦点
计算机视觉与模式识别
2014-01-07 v1
摘要
由于复杂的彩色背景、低分辨率等原因,从视频帧图像中提取和识别孟加拉语文本具有挑战性。在本文中,我们提出了一种针对此类复杂背景视频帧的孟加拉语文本提取与识别算法。这里提出了一种两步法。首先,利用基于行轮廓的信息将文本行分割为单词;利用文本块的一阶梯度值来寻找词间距。接下来,对每个单词应用局部二值化技术,并利用这些单词重构文本行。其次,将此二值化文本块送入 OCR 进行识别。
引用
@article{arxiv.1401.1190,
title = {Bangla Text Recognition from Video Sequence: A New Focus},
author = {Souvik Bhowmick and Purnendu Banerjee},
journal= {arXiv preprint arXiv:1401.1190},
year = {2014}
}