中文

基于遮挡感知的时序一致性无姿态完成:用于 3D 人体-物体交互重建

计算机视觉与模式识别 2025-09-16 v3 人工智能

摘要

我们提出了一个新框架,用于从单目视频中重建动态人体-物体交互,克服了遮挡和时序不一致性的挑战。传统的 3D 重建方法通常假设物体为静态或动态主体完全可见,从而在这些假设被违反——尤其是在发生相互遮挡时——时导致性能下降。为此,我们的框架利用基于遮挡的完成来推断部分遮蔽区域的完整结构。不同于常规方法仅针对单个帧操作,我们的方法整合了时序上下文,通过视频序列中的一致性来逐步细化和稳定重建。这种无模板的策略适应于各种条件,而无需依赖预定义模型,显著增强了动态场景中精细细节的恢复。我们在具有挑战性的单目视频上使用 3D 高斯溅射进行验证,证明了我们的方法在处理遮挡和维持时序稳定性方面优于现有技术。

关键词

引用

@article{arxiv.2507.08137,
  title  = {Occlusion-Aware Temporally Consistent Amodal Completion for 3D Human-Object Interaction Reconstruction},
  author = {Hyungjun Doh and Dong In Lee and Seunggeun Chi and Pin-Hao Huang and Kwonjoon Lee and Sangpil Kim and Karthik Ramani},
  journal= {arXiv preprint arXiv:2507.08137},
  year   = {2025}
}

备注

ACM MM 2025