大型视觉语言模型能否检测生成AI中的图片版权侵权
计算机视觉与模式识别
2025-02-25 v1 人工智能
计算与语言
摘要
生成式AI因其能够合成高质量内容的能力,引发日益担忧其不当生成受版权保护材料的可能性。虽然近期研究提出了各种方法以解决版权问题,但大型视觉语言模型(LVLMs)检测版权侵权的能力尚未得到广泛探讨。本文聚焦评估最新LVLMs在版权检测方面的能力,构建了包含正样本(违反知名IP版权的图像)与模糊负样本(虽似但不构成侵权的图像)的基准数据集。该数据集通过高级提示工程技术构建。随后我们对领先的LVLMs进行评估。实验结果表明,LVLMs易产生过拟合现象,导致部分负样本被误分类为IP侵权案例。本文最后分析了这些失效案例,并提出缓解过拟合问题的潜在解决方案。
引用
@article{arxiv.2502.16618,
title = {Can Large Vision-Language Models Detect Images Copyright Infringement from GenAI?},
author = {Qipan Xu and Zhenting Wang and Xiaoxiao He and Ligong Han and Ruixiang Tang},
journal= {arXiv preprint arXiv:2502.16618},
year = {2025}
}