谈 AI 生成:版权与生成式 AI 供应链
计算机与社会
2024-03-05 v2
摘要
“生成式 AI 是否侵犯版权?”是一个紧迫的问题,同时也是一个困难的问题,原因有二。首先,“生成式 AI”并非某一家公司的一款产品,而是对一套松散相关技术的笼统称呼,包括像 ChatGPT 这样的对话文本聊天机器人、像 Midjourney 和 DALL-E 这样的图像生成器、像 GitHub Copilot 这样的编程助手,以及作曲和生成视频的系统。这些系统行为不同,引发的法律问题也不同。第二个问题是版权法出了名的复杂,而生成式 AI 系统恰好触及了它的诸多角落:作者身份、相似性、直接与间接责任、合理使用以及许可等。这些问题无法孤立分析,因为处处皆有联系。在本文中,我们旨在为这一混乱带来秩序。为此,我们引入生成式 AI 供应链:一组相互关联的环节,将训练数据(数百万张猫的图片)转化为生成内容(一张全新的、可能从未见过且从未存在的猫的图片)。将生成式 AI 拆解为这些组成环节,揭示了企业及用户在哪些环节上做出了具有版权后果的选择。它使我们能够追踪上游技术设计对下游使用的影响,并评估在这些复杂的社会技术系统中,当侵权发生时由谁承担责任。由于我们紧密结合了生成式 AI 的技术,得以对版权问题提供更多洞见。我们并未就谁应或不应承担责任给出确定性答案,而是指出了法院在应对这些问题时必须作出的关键裁决,并点明了不同责任制度可能带来的后果。
引用
@article{arxiv.2309.08133,
title = {Talkin' 'Bout AI Generation: Copyright and the Generative-AI Supply Chain},
author = {Katherine Lee and A. Feder Cooper and James Grimmelmann},
journal= {arXiv preprint arXiv:2309.08133},
year = {2024}
}
备注
Forthcoming, Journal of the Copyright Society of the USA '24