训练即一切:人工智能、版权与公平训练
计算机与社会
2023-05-08 v1 人工智能
摘要
为习得行为,当前革命性一代 AI 须以海量已发布图像、文字作品与声音为训练素材,其中许多落入版权法核心客体范畴。对部分人而言,以受版权保护作品作为 AI 训练集仅属过渡性、非消耗性使用,并未实质干扰所有者内容或其版权。以此类内容训练 AI 引擎的企业常认为,依美国法该使用应被视为“合理使用”(他国或称“fair dealing”)。反之,诸多版权所有者及其支持者则认为,将受版权作品纳入 AI 训练集构成对所有者知识产权之盗用,故依法绝非合理使用。此争辩关乎 AI 及其应用的未来走向。在本文中,我们分析赞成与反对将 AI 训练集中受版权作品使用视为合理使用之论据。我们称此种合理使用为“公平训练”(fair training)。我们辨明争辩双方既有有力亦有谬误之论点。此外,我们试图拓宽视角,权衡允许 AI 轻易以受版权作品为训练集以促进其开发、改进、采纳与扩散所带来的社会成本(如某些人类就业被替代)与收益(如基于 AI 应对环境破坏等全球议题之新可能)。最后我们提出,置于贫困、平等、气候变化与生物多样性丧失等巨大社会挑战之更广语境中,AI 与受版权作品之争或系茶杯风暴,而 AI 或可为解局之一部分。
引用
@article{arxiv.2305.03720,
title = {Training Is Everything: Artificial Intelligence, Copyright, and Fair Training},
author = {Andrew W. Torrance and Bill Tomlinson},
journal= {arXiv preprint arXiv:2305.03720},
year = {2023}
}
备注
22 pages