合成任意人、任意地、任意姿态
计算机视觉与模式识别
2023-11-07 v2
摘要
我们处理野外人体图像合成任务,其首要目标是在任意图像中给定任意区域的情况下合成完整人体。野外人体合成长期以来是一项具挑战性且未被充分探索的任务,现有方法难以应对极端姿态、遮挡物体与复杂背景。我们的主要贡献是 TriA-GAN,一种关键点引导的 GAN,可合成任意人、任意地、任意给定姿态。我们方法的关键在于投影 GAN 与精心设计的训练策略相结合,其中我们简洁的生成器架构能成功应对野外全身合成的挑战。我们展示 TriA-GAN 相较先前野外全身合成方法有明显提升,且合成所需条件信息更少(关键点 vs DensePose)。最后,我们展示 TriA-GAN 的潜空间与标准无条件编辑技术兼容,可实现文本引导的生成人体编辑。
引用
@article{arxiv.2304.03164,
title = {Synthesizing Anyone, Anywhere, in Any Pose},
author = {Håkon Hukkelås and Frank Lindseth},
journal= {arXiv preprint arXiv:2304.03164},
year = {2023}
}
备注
Accepted at WACV 2024