中文

利用主体感知空间注意力的先验增强时序动作定位

计算机视觉与模式识别 2022-11-11 v1

摘要

时序动作定位(TAL)旨在检测长未剪辑视频中每个动作实例的边界并识别其类别。当前方法同质地处理视频帧,往往对背景和关键目标给予过多关注。这限制了它们定位动作边界的敏感性。为此,我们提出了一种先验增强的时序动作定位方法(PETAL),该方法仅接收 RGB 输入,并将动作主体作为先验融入。该方案利用动作主体的信息,通过一个即插即用的主体感知空间注意力模块(SA-SAM)来生成聚合且以主体为先验的表示。在 THUMOS-14 和 ActivityNet-1.3 数据集上的实验结果表明,所提出的 PETAL 仅使用 RGB 特征便取得了具有竞争力的性能,例如,在 THUMOS-14 数据集上,相比使用 RGB 特征或附加光流特征的最先进方法,mAP 分别提升了 2.41% 或 0.25%。

关键词

引用

@article{arxiv.2211.05299,
  title  = {Prior-enhanced Temporal Action Localization using Subject-aware Spatial Attention},
  author = {Yifan Liu and Youbao Tang and Ning Zhang and Ruei-Sung Lin and Haoqian Wang},
  journal= {arXiv preprint arXiv:2211.05299},
  year   = {2022}
}

备注

5 pages, 2 figures