中文

ConTEXTure:用于生成多视角图像纹理的一致性方法

计算机视觉与模式识别 2024-07-16 v1 机器学习

摘要

我们介绍ConTEXTure,这是一个生成式网络,旨在根据给定的3D网格从多个视角生成纹理图/纹理图集。过程始于从文本提示(例如'Napoleon,正面视图')生成前景视图图像,描述该3D网格。从前景视图图像及其相对摄像机位姿推导出来自不同视角的额外图像。ConTEXTure基于TEXTure网络构建,该网络使用文本提示为六个视角(例如'Napoleon,正面视图'、'Napoleon,左视图'等)生成图像。然而,TEXTure常常为非前景视角生成不准确代表这些视角的图像。为解决此问题,我们采用Zero123++,该方法在给定前景视图图像和网格六个视角的深度图的条件下,同时生成六个指定视角的多视图一致图像。通过利用这些视图一致图像,ConTEXTure能够同时从所有视图图像中学习纹理图集,而与以前的方法不同后续学习。这种方法确保从各种视角(包括背面、侧面、底面和顶面)渲染的图像不受视角不规则性的影响。

关键词

引用

@article{arxiv.2407.10558,
  title  = {ConTEXTure: Consistent Multiview Images to Texture},
  author = {Jaehoon Ahn and Sumin Cho and Harim Jung and Kibeom Hong and Seonghoon Ban and Moon-Ryul Jung},
  journal= {arXiv preprint arXiv:2407.10558},
  year   = {2024}
}

备注

11 pages, 7 figures