中文

CompleteMe:基于参考图像的人类图像完成

计算机视觉与模式识别 2025-04-29 v1

摘要

近期的人类图像完成方法通常可以重建合理的身体形状,但往往难以保留特定服装图案或独特配件等细节,除非使用显式的参考图像。即使是最先进的参考图像基于图像填充方法,也难以准确捕获并整合来自参考图像的细粒度细节。为此,我们提出CompleteMe,一种新的参考图像基于人类图像完成框架。CompleteMe 采用双U-Net架构结合区域聚焦注意力(Region-focused Attention, RFA)模块,显式引导模型注意力聚焦于参考图像中相关的区域。该方法有效捕获细节并确保语义对应性显著提高了完成图像的保真度和一致性。此外,我们引入了一个专为评估参考图像基于人类图像完成任务而设计的具有挑战性的基准数据集。大量实验表明,我们提出的方法在视觉质量和语义一致性方面优于现有技术。项目页面:https://liagm.github.io/CompleteMe/。

关键词

引用

@article{arxiv.2504.20042,
  title  = {CompleteMe: Reference-based Human Image Completion},
  author = {Yu-Ju Tsai and Brian Price and Qing Liu and Luis Figueroa and Daniil Pakhomov and Zhihong Ding and Scott Cohen and Ming-Hsuan Yang},
  journal= {arXiv preprint arXiv:2504.20042},
  year   = {2025}
}

备注

Project page: https://liagm.github.io/CompleteMe/