IPDreamer:基于复杂图像提示的外观可控三维物体生成
计算机视觉与模式识别
2024-10-23 v6
摘要
近期三维生成取得显著进展,诸如 DreamFusion 等方法利用大规模文本到图像扩散模型来引导三维物体生成。这些方法能够合成细节丰富且逼真纹理的物体。然而,此类文本到三维模型所产三维物体的外观常不可预测,且单图像到三维方法难以处理缺乏明确主体的图像,使从复杂图像生成外观可控的三维物体变得复杂。为应对这些挑战,我们提出 IPDreamer,一种从复杂 mage rompts(图像提示)中捕获精细外观特征,并使合成三维物体与这些提取特征对齐的新方法,从而实现高保真、外观可控的三维物体生成。我们的实验表明,IPDreamer 持续生成与文本及复杂图像提示对齐的高质量三维物体,凸显了其在外观可控复杂三维物体生成上的良好能力。我们的代码见 https://github.com/zengbohan0217/IPDreamer。
引用
@article{arxiv.2310.05375,
title = {IPDreamer: Appearance-Controllable 3D Object Generation with Complex Image Prompts},
author = {Bohan Zeng and Shanglin Li and Yutang Feng and Ling Yang and Hong Li and Sicheng Gao and Jiaming Liu and Conghui He and Wentao Zhang and Jianzhuang Liu and Baochang Zhang and Shuicheng Yan},
journal= {arXiv preprint arXiv:2310.05375},
year = {2024}
}
备注
20 pages, 12 figures