中文

朝向改进视频中的时空动作识别

计算机视觉与模式识别 2020-12-16 v1

摘要

时空动作识别致力于定位并分类视频中的动作。受最新最先进的实时目标检测器You Only Watch Once (YOWO)的启发,我们旨在修改其结构以提高动作检测精度并减少计算时间。具体而言,我们提出四种新方法试图改进YOWO,并通过修改损失函数解决视频中类别不平衡问题。我们考虑两个中等规模数据集来应用我们对YOWO的修改——流行的联合标注人体运动数据库(J-HMDB-21)以及由卡内基梅隆大学衍生初创公司Agot.AI提供的餐厅视频私有数据集。后者涉及小物体快速移动动作以及不平衡数据类别,使动作定位任务更具挑战性。我们在GitHub仓库 https://github.com/stoneMo/YOWOv2 中实现了所提方法。

关键词

引用

@article{arxiv.2012.08097,
  title  = {Towards Improving Spatiotemporal Action Recognition in Videos},
  author = {Shentong Mo and Xiaoqing Tan and Jingfei Xia and Pinxu Ren},
  journal= {arXiv preprint arXiv:2012.08097},
  year   = {2020}
}