中文

Flux-Sculptor:通过分解空间流控制实现文本驱动的富属性人像编辑

计算机视觉与模式识别 2025-07-08 v1

摘要

文本驱动的人像编辑具有广泛的应用前景,但也面临诸多挑战。理想的文本驱动人像编辑方法应实现精确定位和恰当的内容修改,但现有方法难以平衡重建保真度和编辑灵活性。为此,我们提出了Flux-Sculptor,一个基于Flux的框架,用于精准文本驱动人像编辑。我们的框架引入了Prompt-Aligned Spatial Locator(PASL),准确识别相关编辑区域,同时提出Structure-to-Detail Edit Control(S2D-EC)策略,通过顺序掩码引导的潜在表示和注意力值融合,空间引导去噪过程。大量实验表明,Flux-Sculptor 在富属性编辑和人脸信息保留方面超越了现有方法,成为实际人像编辑的强有力候选方案。项目页面已提供。

关键词

引用

@article{arxiv.2507.03979,
  title  = {Flux-Sculptor: Text-Driven Rich-Attribute Portrait Editing through Decomposed Spatial Flow Control},
  author = {Tianyao He and Runqi Wang and Yang Chen and Dejia Song and Nemo Chen and Xu Tang and Yao Hu},
  journal= {arXiv preprint arXiv:2507.03979},
  year   = {2025}
}

备注

17 pages, 17 figures