中文

有害 AI 言论中的责任归谁?

计算机与社会 2023-08-21 v2 人工智能

摘要

生成式 AI,尤其是基于文本的“基础模型”(在包括互联网在内的海量多样信息上训练的大模型),可生成在广泛责任制度下可能存在问题的言论。机器学习从业者定期对模型进行“红队”测试,以识别并缓解此类问题言论:从 falsely 指控他人严重不当行为的“幻觉”,到制造原子弹的配方。一个关键问题是,这些经红队测试的行为在美国法律下是否确实给模型创建者与部署者带来任何责任风险,从而激励对安全机制的投资。我们考察了三种责任制度,并将其与红队测试模型行为的常见示例相联系:诽谤、构成犯罪行为组成部分的言论,以及错误致死。我们发现,任何第 230 条豁免分析或下游责任分析都与算法设计的技术细节紧密交织。并且,要真正判定模型(及其相关方)对生成言论负有责任存在诸多障碍。我们认为,在这些情形下 AI 不应被类别化豁免责任,且当法院应对平台算法已有的精细复杂性时,生成式 AI 的技术细节正带来更棘手的疑问。法院与政策制定者在评估这些问题时,应仔细考量其创设了何种技术设计激励。

关键词

引用

@article{arxiv.2308.04635,
  title  = {Where's the Liability in Harmful AI Speech?},
  author = {Peter Henderson and Tatsunori Hashimoto and Mark Lemley},
  journal= {arXiv preprint arXiv:2308.04635},
  year   = {2023}
}

备注

Published in the Journal of Free Speech Law (2023)