中文

从视觉词袋到视觉语法:利用语言建模进行图像分类

计算机视觉与模式识别 2017-03-17 v1

摘要

视觉词袋(Bag-of-Visual-Words, BoVW)是一种视觉描述技术,旨在通过将低层特征空间划分为潜在对应视觉概念的特征空间区域并赋予该空间更高价值来缩短语义鸿沟。本文基于视觉词袋范式,对语言语法的三个主要特性进行了概念分析,并探讨了如何将其适配到计算机视觉与图像理解领域。对视觉语法的评估表明,应用所提出的技术可获得分类精度和/或描述符大小的正向提升。

关键词

引用

@article{arxiv.1703.05571,
  title  = {From visual words to a visual grammar: using language modelling for image classification},
  author = {Antonio Foncubierta-Rodríguez and Henning Müller and Adrien Depeursinge},
  journal= {arXiv preprint arXiv:1703.05571},
  year   = {2017}
}