中文

应用标准推进大语言模型的上游与下游伦理

计算机与社会 2023-06-13 v2 人工智能 计算与语言

摘要

本文探讨 AI 所有者如何借鉴其他内容创作行业中既有的行为准则与伦理标准,为 AI 生成内容开发保障措施。文章深入分析了大语言模型(LLMs)伦理意识的现状。通过剖析 LLM 的内容生成机制,确定了可有效应用保障措施的四个关键领域(上游/下游,以及用户提示/回答处)。随后对这四个领域进行比较分析,并从成本、有效性及与既有行业实践的一致性方面评估现有伦理保障措施。本文的核心论点是:现有的 IT 相关伦理准则虽适用于传统 IT 工程,却不足以应对基于 LLM 的内容生成所带来的挑战。借鉴新闻业既有实践,我们为从事 LLM 生成内容分发与销售的企业提出潜在标准。最后,强调了上游数据集策划与下游伦理基准测试之间潜在的利益冲突,以表明亟需超越单纯输出、进行更宽泛评估的必要性。本研究引发了关于这一快速发展内容生成领域中伦理影响的细致讨论。

关键词

引用

@article{arxiv.2306.03503,
  title  = {Applying Standards to Advance Upstream & Downstream Ethics in Large Language Models},
  author = {Jose Berengueres and Marybeth Sandell},
  journal= {arXiv preprint arXiv:2306.03503},
  year   = {2023}
}

备注

8 pages, 4 tables, 2 figures