中文

Warfare:破解 AI 生成内容的水印保护

计算机视觉与模式识别 2025-02-04 v4 人工智能

摘要

AI 生成内容(AIGC)正迅速扩张,相关服务利用先进生成模型创作逼真图像与流畅文本。对此类内容进行监管以防止违规行为(如未经授权的商业化或不安全内容传播)至关重要。水印是一种用于内容溯源与验证的有前景方案,但我们展示了其面对两类关键攻击的脆弱性:(1)水印移除,即对抗者擦除嵌入标记以规避监管;(2)水印伪造,即其生成带伪造水印的非法内容,导致错误溯源。我们提出 Warfare,一个利用预训练扩散模型进行内容处理、并利用生成对抗网络进行水印操作的统一攻击框架。跨数据集与嵌入设置的评估表明,Warfare 在保持内容质量的同时实现了高成功率。我们进一步引入 Warfare-Plus,在不牺牲有效性的前提下提升效率。代码见 https://github.com/GuanlinLee/warfare。

关键词

引用

@article{arxiv.2310.07726,
  title  = {Warfare:Breaking the Watermark Protection of AI-Generated Content},
  author = {Guanlin Li and Yifei Chen and Jie Zhang and Shangwei Guo and Han Qiu and Guoyin Wang and Jiwei Li and Tianwei Zhang},
  journal= {arXiv preprint arXiv:2310.07726},
  year   = {2025}
}