中文

时间中的手势:将人体运动编码为时间图像

计算机视觉与模式识别 2016-08-09 v1

摘要

本工作的目标是在图像时间序列中识别并定位短时序信号,且训练时缺乏强监督。为此,我们提出一种图像编码,以适合用ConvNet学习的格式简洁地表示视频序列中的人体运动。该编码将图像中的姿态信息缩减为单列,大幅降低网络的输入需求,同时保留用于识别的本质信息。该编码应用于英国手语(British Sign Language, BSL)视频中手势信号的识别与定位任务。我们证明,使用所提编码,仅利用弱(片段级)监督并存在相当标签噪声的情况下,可从持续数百帧的片段中学习到短至10帧时长的手势。

关键词

引用

@article{arxiv.1608.02059,
  title  = {Signs in time: Encoding human motion as a temporal image},
  author = {Joon Son Chung and Andrew Zisserman},
  journal= {arXiv preprint arXiv:1608.02059},
  year   = {2016}
}