图像文档中的金融表格提取
计算机视觉与模式识别
2024-05-10 v1
摘要
表格提取长期以来一直是金融服务中普遍存在的问题。在图像领域,这更具挑战性,因为内容被锁定在繁琐的像素格式中。幸运的是,深度学习在图像分割、OCR 和序列建模方面的进步为实现令人瞩目的结果提供了必要的强大支持。本文提出了一条端到端的流水线,用于识别、提取和转录图像文档中的表格内容,同时以高保真度保留原始的空间关系。
引用
@article{arxiv.2405.05260,
title = {Financial Table Extraction in Image Documents},
author = {William Watson and Bo Liu},
journal= {arXiv preprint arXiv:2405.05260},
year = {2024}
}