中文

Mirage:利用大型视觉语言模型揭示合成图像中的隐藏伪影

计算机视觉与模式识别 2025-10-07 v1

摘要

图像生成模型的最新进展催生了能够生成合成图像的模型,这些合成图像越来越难以被标准 AI 检测器识别,尽管人类通常仍能将其分辨出来。为了识别这一差异,我们引入了 \textbf{Mirage},这是一个精心策划的数据集,包含多种展现出可见伪影的 AI 生成图像,而当前最先进的检测方法在这些图像上基本失效。此外,我们研究了大型视觉语言模型 (LVLMs) 是否可以用于可解释的 AI 图像检测,这些模型在各种任务中越来越多地被用作人类判断的替代品。我们在 Mirage 和现有基准数据集上的实验表明,尽管 LVLMs 在检测具有可见伪影的 AI 生成图像方面非常有效,但当面对缺乏此类线索的图像时,其性能会下降。

关键词

引用

@article{arxiv.2510.03840,
  title  = {Mirage: Unveiling Hidden Artifacts in Synthetic Images with Large Vision-Language Models},
  author = {Pranav Sharma and Shivank Garg and Durga Toshniwal},
  journal= {arXiv preprint arXiv:2510.03840},
  year   = {2025}
}

备注

ACM MM'25, MALLM Workshop