中文

VoxelKeypointFusion:通用多视角多人姿态估计

计算机视觉与模式识别 2024-12-23 v3 人机交互

摘要

在计算机视觉领域,准确地从各种视角估计多个个体的姿态并确保估计可靠性是一项艰巨的挑战。本工作对多视角多人姿态估计算法对未见数据集的泛化能力进行了广泛评估,并提出了在该任务上性能卓越的新算法。我们还研究了额外利用深度信息所带来的改进。由于新的方法不仅能良好地泛化到未见数据集,还能适应不同的关键点,因此首次提出了多视角多人全身姿态估计器。为支持进一步的研究,所有工作均公开 accessible。

关键词

引用

@article{arxiv.2410.18723,
  title  = {VoxelKeypointFusion: Generalizable Multi-View Multi-Person Pose Estimation},
  author = {Daniel Bermuth and Alexander Poeppel and Wolfgang Reif},
  journal= {arXiv preprint arXiv:2410.18723},
  year   = {2024}
}