文本生成图像的透视(不)一致性
图形学
2022-06-30 v1 人工智能
计算机视觉与模式识别
计算机与社会
摘要
在 OpenAI 的 DALL-E-2 文本生成图像合成引擎中输入“约翰内斯·维米尔所绘戴珍珠耳环的海獭”或“时代广场滑板上泰迪熊的照片”,你定会对这些令人愉悦且惊人贴切的结果感到满意。合成高度逼真图像的能力——似乎除想象力外别无限制——必将催生许多令人兴奋且富有创意的应用。这些图像也可能给图像取证领域带来新挑战。鉴于文本生成图像并非基于显式几何建模,且人类视觉系统常对甚至明显的几何不一致视而不见,我们初步探究了 DALL-E-2 合成图像的透视一致性,以确定基于几何的取证分析是否有助于检测这类新型合成媒体。
引用
@article{arxiv.2206.14617,
title = {Perspective (In)consistency of Paint by Text},
author = {Hany Farid},
journal= {arXiv preprint arXiv:2206.14617},
year = {2022}
}