中文

大型视觉语言模型能否检测生成AI中的图片版权侵权

计算机视觉与模式识别 2025-02-25 v1 人工智能 计算与语言

摘要

生成式AI因其能够合成高质量内容的能力,引发日益担忧其不当生成受版权保护材料的可能性。虽然近期研究提出了各种方法以解决版权问题,但大型视觉语言模型(LVLMs)检测版权侵权的能力尚未得到广泛探讨。本文聚焦评估最新LVLMs在版权检测方面的能力,构建了包含正样本(违反知名IP版权的图像)与模糊负样本(虽似但不构成侵权的图像)的基准数据集。该数据集通过高级提示工程技术构建。随后我们对领先的LVLMs进行评估。实验结果表明,LVLMs易产生过拟合现象,导致部分负样本被误分类为IP侵权案例。本文最后分析了这些失效案例,并提出缓解过拟合问题的潜在解决方案。

关键词

引用

@article{arxiv.2502.16618,
  title  = {Can Large Vision-Language Models Detect Images Copyright Infringement from GenAI?},
  author = {Qipan Xu and Zhenting Wang and Xiaoxiao He and Ligong Han and Ruixiang Tang},
  journal= {arXiv preprint arXiv:2502.16618},
  year   = {2025}
}