中文

EXIM:一种用于文本引导三维形状生成的显式-隐式混合表示

计算机视觉与模式识别 2023-12-01 v2

摘要

本文提出一种生成三维形状的新型文本引导技术。该技术利用一种混合的三维形状表示,即 EXIM,结合显式与隐式表示的优点。具体而言,显式阶段控制生成的三维形状的拓扑并支持局部修改,而隐式阶段精炼形状并为其绘制合理颜色。此外,该混合方法将形状与颜色分离,并生成以形状为条件的颜色,以确保形状-颜色一致性。与现有 state-of-the-art 方法不同,我们无需耗时的逐形状优化,也不依赖训练或测试时优化中的人工标注文本,即可从自然语言描述实现高保真形状生成。进一步,我们展示了利用文本诱导的三维形状生成风格一致的室内场景的适用性。通过大量实验,我们证明了结果令人信服的质量以及生成形状与输入文本的高度一致性,显著超越现有方法性能。代码与模型发布于 https://github.com/liuzhengzhe/EXIM。

关键词

引用

@article{arxiv.2311.01714,
  title  = {EXIM: A Hybrid Explicit-Implicit Representation for Text-Guided 3D Shape Generation},
  author = {Zhengzhe Liu and Jingyu Hu and Ka-Hei Hui and Xiaojuan Qi and Daniel Cohen-Or and Chi-Wing Fu},
  journal= {arXiv preprint arXiv:2311.01714},
  year   = {2023}
}

备注

SIGGRAPH Asia 2023 & TOG Project page: https://liuzhengzhe.github.io/EXIM.github.io/