面向视频分割与识别的端到端生成式框架
计算机视觉与模式识别
2016-03-18 v2
摘要
我们描述了一种用于人类活动分割与识别的端到端生成式方法。在该方法中,基于约化费舍尔向量的视觉表示与用于识别的结构化时序模型相结合。我们表明,费舍尔向量的统计特性使其成为高斯混合等生成式模型特别合适的前端。该系统在复杂活动的识别及其解析为动作单元两方面均进行了评估。使用从人类烹饪活动到动物行为的多种视频数据集,我们的实验证明,对于较大规模的数据集,即当有足够数据用于训练结构化生成式模型时,所得到的架构优于当前最先进的方法。
引用
@article{arxiv.1509.01947,
title = {An end-to-end generative framework for video segmentation and recognition},
author = {Hilde Kuehne and Juergen Gall and Thomas Serre},
journal= {arXiv preprint arXiv:1509.01947},
year = {2016}
}
备注
Proc. of IEEE Winter Conference on Applications of Computer Vision (WACV), 2016