中文

基于混合 HMM Maxout 模型的端到端文本识别

计算机视觉与模式识别 2013-10-08 v1

摘要

自然场景中的文本检测与识别问题已被证明比文档中的相应问题更具挑战性,以往的大多数工作仅专注于该问题的单一环节。在本工作中,我们提出了针对字符和单词识别问题的新解决方案,并展示了如何将这些方案结合到一个端到端的文本识别系统中。为此,我们利用了最近提出的 Maxout 网络以及已被证明对语音识别有用的混合 HMM 模型。利用这些组件,我们构建了一个可调节且高精度的识别系统,其在 ICDAR 2003 和 SVT 基准数据集的所有子问题上均超越了最先进(state-of-the-art)的结果。

关键词

引用

@article{arxiv.1310.1811,
  title  = {End-to-End Text Recognition with Hybrid HMM Maxout Models},
  author = {Ouais Alsharif and Joelle Pineau},
  journal= {arXiv preprint arXiv:1310.1811},
  year   = {2013}
}

备注

9 pages, 7 figures