AdaHuman:基于组合式多视图扩散的可动精细 3D 人体生成
计算机视觉与模式识别
2025-06-02 v1
摘要
现有的图像到 3D 虚拟形象生成方法难以生成适合真实世界应用的高度精细、可动画化的虚拟形象。我们引入了 AdaHuman,这是一个新颖的框架,可以从单张野外图像生成高保真可动 3D 虚拟形象。AdaHuman 包含两项关键创新:(1) 一个姿态条件 3D 联合扩散模型,该模型在任意姿态下合成一致的多视图图像,并在每个扩散步骤生成相应的 3D Gaussian Splats (3DGS) 重建;(2) 一个组合式 3DGS 细化模块,通过图像到图像的细化增强局部身体部位的细节,并使用新颖的裁剪感知相机射线图将它们无缝集成,从而产生连贯的精细 3D 虚拟形象。这些组件使 AdaHuman 能够生成具有最小自遮挡的高度逼真标准化 A-pose 虚拟形象,从而能够使用任何输入动作进行绑定和动画。在公共基准和野外图像上的广泛评估表明,AdaHuman 在虚拟形象重建和重姿态方面均显著优于最先进的方法。代码和模型将公开用于研究目的。
引用
@article{arxiv.2505.24877,
title = {AdaHuman: Animatable Detailed 3D Human Generation with Compositional Multiview Diffusion},
author = {Yangyi Huang and Ye Yuan and Xueting Li and Jan Kautz and Umar Iqbal},
journal= {arXiv preprint arXiv:2505.24877},
year = {2025}
}
备注
Website: https://nvlabs.github.io/AdaHuman