中文

理解大语言模型的能力、局限与社会影响

计算与语言 2021-02-05 v1 机器学习

摘要

2020 年 10 月 14 日,来自 OpenAI、斯坦福以人为中心人工智能研究所及其他大学的研究人员齐聚一堂,讨论围绕 GPT-3(当时公开披露的最大稠密语言模型)的开放研究问题。会议在查塔姆研究所规则下进行。讨论者来自多种研究背景,包括计算机科学、语言学、哲学、政治学、传播学、网络政策等。广泛而言,讨论围绕两个主要问题:1)大语言模型的技术能力与局限是什么?2)大语言模型的广泛使用产生了何种社会效应?在此,我们按上述两个主题组织的详细讨论摘要。

关键词

引用

@article{arxiv.2102.02503,
  title  = {Understanding the Capabilities, Limitations, and Societal Impact of Large Language Models},
  author = {Alex Tamkin and Miles Brundage and Jack Clark and Deep Ganguli},
  journal= {arXiv preprint arXiv:2102.02503},
  year   = {2021}
}