中文

SwiftTailor:基于几何图像表示的高效 3D 服装生成

计算机视觉与模式识别 2026-03-20 v1 图形学

摘要

现实且高效的 3D 服装生成一直是计算机视觉和数字时尚领域的长期挑战。现有方法通常依赖大型视觉-语言模型生成序列化的 2D 缝纶图案,然后通过诸如 GarmentCode 之类的服装建模框架将其转化为仿真就绪的 3D 网格。尽管这些方法产生了高质量的结果,但往往 suffer from 推断时间较慢,范围从 30 秒到 1 分钟。在本工作中,我们引入了 SwiftTailor,一个新型两个阶段的框架,通过紧凑的几何图像表示统一缝纶图案推理和基于几何的网格合成。SwiftTailor 由两个轻量级模块组成:PatternMaker,一个高效视觉-语言模型,从多样化的输入模态预测缝纶图案;GarmentSewer,一个高效稠密预测变换器,将这些图案转换为一种新的 Garment Geometry Image,对所有服装面板在统一 UV 空间中的 3D 表面进行编码。最终的 3D 网格通过一种高效的逆映射过程重建,包含重网格和动态接缝算法,直接组装服装,从而在摊销物理仿真成本方面实现了优化。广泛的在 Multimodal GarmentCodeData 上的实验表明,SwiftTailor 在准确性和视觉保真度方面实现了领先的结果,同时显著减少了推断时间。这一工作为下一代 3D 服装生成提供了一个可扩展、可解释且高性能的解决方案。

关键词

引用

@article{arxiv.2603.19053,
  title  = {SwiftTailor: Efficient 3D Garment Generation with Geometry Image Representation},
  author = {Phuc Pham and Uy Dieu Tran and Binh-Son Hua and Phong Nguyen},
  journal= {arXiv preprint arXiv:2603.19053},
  year   = {2026}
}

备注

CVPR 2026