文档图像中的图形对象检测
计算机视觉与模式识别
2020-08-26 v1
摘要
图形元素,特别是表格和图形,包含了文档中最有价值信息的可视化摘要。因此,在文档图像中定位此类图形对象是理解这些图形对象或文档图像内容的初始步骤。在本文中,我们提出了一种新颖的基于端到端可训练深度学习的框架,用于在文档图像中定位图形对象,称为图形对象检测(GOD)。我们的框架是数据驱动的,不需要任何启发式方法或元数据来定位文档图像中的图形对象。GOD 探索了迁移学习和域自适应的概念,以处理文档图像中图形对象检测任务标记训练图像稀缺的问题。在多个公共基准数据集:ICDAR-2013、ICDAR-POD2017 和 UNLV 上进行的性能分析表明,与最先进的技术相比,我们的模型产生了有前景的结果。
引用
@article{arxiv.2008.10843,
title = {Graphical Object Detection in Document Images},
author = {Ranajit Saha and Ajoy Mondal and C. V. Jawahar},
journal= {arXiv preprint arXiv:2008.10843},
year = {2020}
}
备注
8