中文

数字与扫描图像的字体识别及字符提取

计算机视觉与模式识别 2013-05-20 v1

摘要

字体识别与字符提取至关重要,因为在许多场景下数据以无法像图像形式或硬拷贝那样直接处理的形式存在。因此,本文开发的程序主要涉及识别字体(Times New Roman、Arial 和 Comic Sans MS),随后使用简单的基于相关性的方法恢复文本,该方法将二值模板与输入图像的文本字符进行相关匹配。所有提取过程均在存在少量噪声的情况下完成,因为图像可能因复印而产生噪声图案。该方法的意义在于从各种监控(Surveillance)摄像头录像甚至更多来源中提取数据。该方法基于 Matlab\c{opyright} 开发,接收输入图像并从中恢复文本和字体信息至文本文件中。

关键词

引用

@article{arxiv.1305.4064,
  title  = {Font Acknowledgment and Character Extraction of Digital and Scanned Images},
  author = {Syed Muhammad Arsalan Bashir},
  journal= {arXiv preprint arXiv:1305.4064},
  year   = {2013}
}

备注

5 pages, 5 figures, 1 table, Published with International Journal of Computer Applications (IJCA)