朝向改进视频中的时空动作识别
计算机视觉与模式识别
2020-12-16 v1
摘要
时空动作识别致力于定位并分类视频中的动作。受最新最先进的实时目标检测器You Only Watch Once (YOWO)的启发,我们旨在修改其结构以提高动作检测精度并减少计算时间。具体而言,我们提出四种新方法试图改进YOWO,并通过修改损失函数解决视频中类别不平衡问题。我们考虑两个中等规模数据集来应用我们对YOWO的修改——流行的联合标注人体运动数据库(J-HMDB-21)以及由卡内基梅隆大学衍生初创公司Agot.AI提供的餐厅视频私有数据集。后者涉及小物体快速移动动作以及不平衡数据类别,使动作定位任务更具挑战性。我们在GitHub仓库 https://github.com/stoneMo/YOWOv2 中实现了所提方法。
引用
@article{arxiv.2012.08097,
title = {Towards Improving Spatiotemporal Action Recognition in Videos},
author = {Shentong Mo and Xiaoqing Tan and Jingfei Xia and Pinxu Ren},
journal= {arXiv preprint arXiv:2012.08097},
year = {2020}
}