中文

DiverseDream:基于增强文本嵌入的多样化文本到 3D 合成

计算机视觉与模式识别 2024-07-18 v2

摘要

文本到 3D 合成近期作为一种新方法涌现,其通过采用预训练的文本到图像模型作为引导视觉先验来采样 3D 模型。现有文本到 3D 方法中一个有趣但尚未充分探索的问题是,通过优化采样过程获得的 3D 模型往往出现模式崩溃,从而导致结果多样性较差。本文对该问题进行了分析,并找出了导致这种有限多样性的潜在原因,这促使我们设计了一种新方法,考虑从相同文本提示联合生成不同的 3D 模型。我们提出通过参考图像的文本反演来使用增强文本提示,以丰富联合生成的多样性。我们定性和定量地表明,该方法提升了文本到 3D 合成的多样性。项目页面:https://diversedream.github.io

关键词

引用

@article{arxiv.2312.02192,
  title  = {DiverseDream: Diverse Text-to-3D Synthesis with Augmented Text Embedding},
  author = {Uy Dieu Tran and Minh Luu and Phong Ha Nguyen and Khoi Nguyen and Binh-Son Hua},
  journal= {arXiv preprint arXiv:2312.02192},
  year   = {2024}
}

备注

Accepted to ECCV 2024. Project page: https://diversedream.github.io