基于用户真值评估视频关键帧摘要
计算机视觉与模式识别
2017-12-20 v1
摘要
鉴于从视频创建关键帧摘要的巨大兴趣,令人惊讶的是在形式化其评估与比较方面所做甚少。用户研究常被用来证明某提出的方法比一两种竞争方法生成更具吸引力的摘要。但更大规模的比较研究无法切实使用此类用户调查。在此我们提出一种判别能力度量,作为在假设可用一个或多个真值摘要时量化相对均匀基线的改进的形式化方法。利用 VSUMM 视频集合,我们考察了 10 种视频特征类型(包括 CNN 与 SURF)以及 6 种用于匹配两个摘要中帧的方法。我们的结果表明,通过色调直方图的简单帧表示足以用于比较关键帧摘要的目的。我们随后提出了一种在可用真值时比较摘要的形式化协议。
引用
@article{arxiv.1712.06899,
title = {On the Evaluation of Video Keyframe Summaries using User Ground Truth},
author = {Ludmila I. Kuncheva and Paria Yousefi and Iain A. D. Gunn},
journal= {arXiv preprint arXiv:1712.06899},
year = {2017}
}
备注
12 pages, 10 figures, 2 tables