通过听与看实现自我中心视频快进
计算机视觉与模式识别
2018-06-13 v1
摘要
装备精良的可穿戴设备显著的技术进步正推动长第一人称视频产量的增加。然而,由于这些视频大多包含冗长乏味的部分,它们常被遗忘或从未被观看。尽管已提出大量通过突出相关时刻来快进这些视频的技术,其中多数仅基于图像。这些技术忽视了当前设备中存在的其他相关传感器,如高保真麦克风。在本工作中,我们提出一种利用从音轨提取的心理声学度量来快进视频的新方法。这些度量可用于估计片段的烦扰度,使我们的方法能强调声音愉悦的时刻。我们方法的有效性通过定性结果以及关于加速倍率与不稳定性的定量结果得到展示。
引用
@article{arxiv.1806.04620,
title = {Fast forwarding Egocentric Videos by Listening and Watching},
author = {Vinicius S. Furlan and Ruzena Bajcsy and Erickson R. Nascimento},
journal= {arXiv preprint arXiv:1806.04620},
year = {2018}
}