ObjectAdd:基于免训练扩散修改方式向图像中添加物体
计算机视觉与模式识别
2025-12-12 v6
摘要
我们介绍了 ObjectAdd,这是一种免训练的扩散修改方法,用于将用户期望的物体添加到用户指定的区域。ObjectAdd 的动机源于:首先,在一个提示词中描述所有事物可能很困难;其次,用户通常需要将物体添加到生成的图像中。为了适应现实世界,我们的 ObjectAdd 在添加物体后保持了准确的图像一致性,其技术创新在于:(1) 嵌入级联拼接,以确保正确的文本嵌入融合;(2) 具有潜空间和注意力注入的物体驱动布局控制,以确保物体进入用户指定的区域;(3) 以注意力重聚焦和物体扩展的方式进行提示图像修复,以确保图像的其余部分保持不变。给定一个文本提示的图像,我们的 ObjectAdd 允许用户指定一个边界框和一个物体,并实现:(1) 在边界框区域内添加物体;(2) 边界框区域外的精确内容;(3) 两个区域之间的完美融合。
引用
@article{arxiv.2404.17230,
title = {ObjectAdd: Adding Objects into Image via a Training-Free Diffusion Modification Fashion},
author = {Ziyue Zhang and Mingbao Lin and Quanjian Song and Yuxin Zhang and Rongrong Ji},
journal= {arXiv preprint arXiv:2404.17230},
year = {2025}
}
备注
12 pages in total