中文

通过预测三维外观、位置与姿态进行人员跟踪

计算机视觉与模式识别 2021-12-09 v1

摘要

本文提出了一种通过预测人物未来三维表示,在单目视频中进行人员跟踪的方法。为实现这一目标,我们首先以稳健的方式从单帧图像中将人物提升至三维空间。这种提升包含了人物的三维姿态、其在三维空间中的位置以及三维外观信息。在跟踪一个人的过程中,我们随时间收集三维观测数据,并以轨迹片段表示。鉴于我们观测数据的三维特性,我们为前述的每个属性构建了时序模型。我们利用这些模型来预测轨迹片段的未来状态,包括三维位置、三维外观和三维姿态。对于未来帧,我们以概率方式计算轨迹片段预测状态与单帧观测之间的相似度。关联问题通过简单的匈牙利匹配解决,匹配结果用于更新相应的轨迹片段。我们在多个基准数据集上评估了我们的方法,并报告了最先进的结果。

关键词

引用

@article{arxiv.2112.04477,
  title  = {Tracking People by Predicting 3D Appearance, Location & Pose},
  author = {Jathushan Rajasegaran and Georgios Pavlakos and Angjoo Kanazawa and Jitendra Malik},
  journal= {arXiv preprint arXiv:2112.04477},
  year   = {2021}
}

备注

Project Page : https://brjathu.github.io/PHALP/