中文

基于梯度差的压缩域文本定位方法

计算机视觉与模式识别 2015-02-23 v1

摘要

本文提出一种基于梯度差的视频和场景图像文本定位方法。输入视频帧/图像首先使用多级二维小波变换进行压缩。获取重建图像的边缘信息,并进一步用于寻找像素间的最大梯度差,然后利用零交叉技术计算检测到的文本块的边界。我们对梯度差和零交叉技术获得的文本块进行逻辑与操作,随后进行连通分量分析以消除误检。最后,对检测到的文本块采用形态学膨胀操作以实现场景文本定位。在公开标准数据集上的实验结果表明,所提方法能够检测和定位不同尺寸、字体和颜色的文本。

关键词

引用

@article{arxiv.1502.03918,
  title  = {Gradient Difference based approach for Text Localization in Compressed domain},
  author = {B. H. Shekar and Smitha M. L},
  journal= {arXiv preprint arXiv:1502.03918},
  year   = {2015}
}

备注

11 pages, Second International Conference on Emerging Research in Computing, Information, Communications and Applications, Elsevier Publications, ISBN: 9789351072638, vol. III, pp: 299-308, held at NMIT, Bangalore August 2014