利用虚构词对图像生成进行对抗攻击
计算机视觉与模式识别
2022-08-09 v1 计算与语言
密码学与安全
机器学习
摘要
文本引导的图像生成模型可通过对抗性设计的非词(nonce words)提示来稳健唤起特定视觉概念以生成图像。本文介绍了两种此类生成方法:混合提示(macaronic prompting),即通过拼接不同语言的子词单元设计隐秘混合词;以及唤起提示(evocative prompting),即设计广义形态特征和现有词足够相似以触发稳健视觉关联的非词。两种方法也可结合以生成与更具体视觉概念关联的图像。本文讨论了这些技术对规避现有内容审核方法、尤其是生成攻击性或有害图像的影响。
引用
@article{arxiv.2208.04135,
title = {Adversarial Attacks on Image Generation With Made-Up Words},
author = {Raphaël Millière},
journal= {arXiv preprint arXiv:2208.04135},
year = {2022}
}