通过预测三维外观、位置与姿态进行人员跟踪
计算机视觉与模式识别
2021-12-09 v1
摘要
本文提出了一种通过预测人物未来三维表示,在单目视频中进行人员跟踪的方法。为实现这一目标,我们首先以稳健的方式从单帧图像中将人物提升至三维空间。这种提升包含了人物的三维姿态、其在三维空间中的位置以及三维外观信息。在跟踪一个人的过程中,我们随时间收集三维观测数据,并以轨迹片段表示。鉴于我们观测数据的三维特性,我们为前述的每个属性构建了时序模型。我们利用这些模型来预测轨迹片段的未来状态,包括三维位置、三维外观和三维姿态。对于未来帧,我们以概率方式计算轨迹片段预测状态与单帧观测之间的相似度。关联问题通过简单的匈牙利匹配解决,匹配结果用于更新相应的轨迹片段。我们在多个基准数据集上评估了我们的方法,并报告了最先进的结果。
引用
@article{arxiv.2112.04477,
title = {Tracking People by Predicting 3D Appearance, Location & Pose},
author = {Jathushan Rajasegaran and Georgios Pavlakos and Angjoo Kanazawa and Jitendra Malik},
journal= {arXiv preprint arXiv:2112.04477},
year = {2021}
}
备注
Project Page : https://brjathu.github.io/PHALP/