视频流中文本字段识别的加权组合方法
计算机视觉与模式识别
2020-02-12 v1
摘要
由于文档识别适用性的显著扩展,对移动设备上的识别需求很高。与扫描仪不同,移动摄像头不能总是确保各种图像畸变的缺失,因此提高识别精度的任务是相关的。移动设备相对于扫描仪的优势在于能够使用视频流输入,这允许获取被识别文档的多幅图像。尽管如此,目前在使用视频流输入时,对组合从不同帧获得的识别结果的问题关注不足。在本文中,我们提出了一种加权文本字符串识别结果组合方法及加权准则,并提供了用于验证其有效性和有效性的实验数据。基于所获得的结果,得出结论:使用这种加权组合对于提高视频流识别结果的质量是适当的。
引用
@article{arxiv.1911.12028,
title = {Methods of Weighted Combination for Text Field Recognition in a Video Stream},
author = {Olga Petrova and Konstantin Bulatov and Vladimir L. Arlazarov},
journal= {arXiv preprint arXiv:1911.12028},
year = {2020}
}
备注
6 pages, 4 figures, 1 table, accepted and presented at International Conference on Machine Vision 2019 (ICMV 2019)