中文

TarPro:针对恶意图像编辑的定向保护

密码学与安全 2025-03-19 v1 计算机视觉与模式识别

摘要

图像编辑技术的快速发展引发了对其被用于生成不适合工作场所(NSFW)内容的担忧。这 necessitates 一种针对恶意编辑的定向保护机制,以阻止恶意编辑同时保持正常的可编辑性。然而,现有的保护方法未能实现这一平衡,由于它们不成比例地干扰所有编辑,同时仍允许一些有害内容被生成。为此,我们提出了 TarPro,一种定向保护框架,可在保持良性修改的同时防止恶意编辑。TarPro 通过一种语义感知约束仅干扰恶意内容,并通过一种轻量级扰动生成器产生更稳定、更难以察觉且更稳健的图像保护扰动。大量实验表明,TarPro 超越了现有方法,实现了高效的保护,同时确保对正常编辑影响最小。我们的结果表明,TarPro 是一种实用的安全受控图像编辑解决方案。

关键词

引用

@article{arxiv.2503.13994,
  title  = {TarPro: Targeted Protection against Malicious Image Editing},
  author = {Kaixin Shen and Ruijie Quan and Jiaxu Miao and Jun Xiao and Yi Yang},
  journal= {arXiv preprint arXiv:2503.13994},
  year   = {2025}
}