电视新闻广播中的叠加文本提取
计算机视觉与模式识别
2016-04-05 v1
摘要
叠加条带中存在的文本数据传达了广播视频中新闻事件的简要描述。由于叠加文本常以广泛变化的格式呈现且常带有动画效果,文本提取过程变得具有挑战性。我们注意到,现有的基于边缘密度的方法因其操作简单和运算速度快,非常适用于我们的应用。然而,这些方法对阈值敏感且假阳性率高。本文中,我们提出一种基于对比度增强的预处理阶段用于叠加文本检测,以及一种无参数的基于边缘密度的方案用于高效的文本条带检测。本文的第二项贡献是一种用于多文本区域跟踪的新方法,并正式辨识了所有可能的检测失败情形。跟踪阶段使我们能够确立文本条带的时间存在性及其随时间的关联。第三项贡献是采用Tesseract OCR来执行利用网络新闻文章进行叠加文本识别的特定任务。所提方法在从三个印度英语电视新闻频道获取的视频以及基准数据集上进行了测试,并被证实具有优越性。
引用
@article{arxiv.1604.00470,
title = {Overlay Text Extraction From TV News Broadcast},
author = {Raghvendra Kannao and Prithwijit Guha},
journal= {arXiv preprint arXiv:1604.00470},
year = {2016}
}
备注
Published in INDICON 2015