中文

面向人类的统一点云视频理解框架

计算机视觉与模式识别 2024-04-01 v1

摘要

人类中心点云视频理解(PVU)是聚焦从人类点云序列中提取和解释人类相关特征的 emerging 领域, 进一步推动下游人类中心任务和应用. 以往的工作通常专注于解决特定任务, 并依赖大量标记数据, 其泛化能力较差. 鉴于人类具有特定特征, 包括人体结构语义和人类运动动力学, 本文提出一种统一框架, 以充分利用先验知识并探索数据自身固有的特征, 实现对通用人类中心点云视频理解. 大量实验表明, 我们的方法在包括动作识别和3D姿态估计等各种人类相关任务上实现了最先进的性能. 所有数据集和代码将很快公开.

关键词

引用

@article{arxiv.2403.20031,
  title  = {A Unified Framework for Human-centric Point Cloud Video Understanding},
  author = {Yiteng Xu and Kecheng Ye and Xiao Han and Yiming Ren and Xinge Zhu and Yuexin Ma},
  journal= {arXiv preprint arXiv:2403.20031},
  year   = {2024}
}

备注

Accepted by CVPR 2024