中文

厘清多面视频摘要:多样性、代表性、覆盖度与重要性之间的权衡

计算机视觉与模式识别 2019-01-07 v1

摘要

本文以统一方式解决视频自动摘要问题。具体地,我们提出一个面向抽取式、基于查询以及实体摘要(在视频中物体、场景、人与人脸等实体层面的摘要)的多面摘要框架。我们研究了若干捕捉多样性、覆盖度、代表性与重要性概念的摘要模型,并论证了这些不同模型依应用而定的效用。尽管先前关于子模摘要方法的工作多聚焦于组合多个模型并学习加权混合,我们关注不同模型与特征化的可解释性,以及它们如何应用于不同领域。我们还给出了关于摘要系统及所涉不同模态的实现细节。我们希望本文的研究能为从业者针对手头问题恰当选择摘要模型提供见解。

关键词

引用

@article{arxiv.1901.01153,
  title  = {Demystifying Multi-Faceted Video Summarization: Tradeoff Between Diversity,Representation, Coverage and Importance},
  author = {Vishal Kaushal and Rishabh Iyer and Khoshrav Doctor and Anurag Sahoo and Pratik Dubal and Suraj Kothawade and Rohan Mahadev and Kunal Dargan and Ganesh Ramakrishnan},
  journal= {arXiv preprint arXiv:1901.01153},
  year   = {2019}
}

备注

Accepted to WACV 2019. arXiv admin note: substantial text overlap with arXiv:1704.01466, arXiv:1809.08846