T2IW:联合文本到图像与水印生成
计算机视觉与模式识别
2025-10-13 v1 多媒体
图像与视频处理
摘要
近期文本条件图像生成模型的发展革新了逼真结果的产出。不幸的是,这也导致了隐私侵犯与虚假信息传播的增多,从而需要对可追溯性、隐私保护及其他安全措施的需求。然而,现有的文本到图像范式缺乏将可追溯消息与图像生成相关联的技术能力。在本研究中,我们引入一项用于联合生成文本到图像与水印(T2IW)的新任务。该T2IW方案通过迫使语义特征与水印信号在像素上兼容,在生成复合图像时对图像质量造成最小损害。此外,通过利用香农信息论与非合作博弈论原理,我们能够从复合图像中分离出显式图像与显式水印。进一步地,我们通过将复合图像置于各种后处理攻击下,以显式水印中观察到的极小像素失真强化了方法的水印鲁棒性。大量实验已证明在图像质量、水印不可见性与水印鲁棒性方面的显著成就,并由我们提出的一套评估指标所支持。
引用
@article{arxiv.2309.03815,
title = {T2IW: Joint Text to Image & Watermark Generation},
author = {An-An Liu and Guokai Zhang and Yuting Su and Ning Xu and Yongdong Zhang and Lanjun Wang},
journal= {arXiv preprint arXiv:2309.03815},
year = {2025}
}