中文

FlexiTex:通过视觉引导增强纹理生成

计算机视觉与模式识别 2025-07-22 v5 人工智能

摘要

最近的纹理生成方法由于利用大规模文本到图像扩散模型所提供的强大生成先验而取得了令人瞩目的成果。然而,抽象的文本提示在提供全局纹理或形状信息方面受限,导致生成的纹理产生模糊或不一致的图案。为解决这一问题,我们提出了 FlexiTex,通过视觉引导嵌入丰富信息来生成高质量纹理。FlexiTex 的核心是视觉引导增强模块,incorporates more specific information from visual guidance 以减少文本提示中的歧义并保留高频细节。为进一步增强视觉引导,我们引入了方向感知适应模块,根据不同的摄像机姿态自动设计方向提示,避免 Janus 问题,保持语义上的全局一致性。凭借视觉引导,FlexiTex 能够在定性和定量上均表现出色,展示了其在实际应用中推动纹理生成的潜力。

关键词

引用

@article{arxiv.2409.12431,
  title  = {FlexiTex: Enhancing Texture Generation via Visual Guidance},
  author = {DaDong Jiang and Xianghui Yang and Zibo Zhao and Sheng Zhang and Jiaao Yu and Zeqiang Lai and Shaoxiong Yang and Chunchao Guo and Xiaobo Zhou and Zhihui Ke},
  journal= {arXiv preprint arXiv:2409.12431},
  year   = {2025}
}

备注

Accepted by AAAI 2025, Project Page: https://patrickddj.github.io/FlexiTex/