理解大语言模型的能力、局限与社会影响
计算与语言
2021-02-05 v1 机器学习
摘要
2020 年 10 月 14 日,来自 OpenAI、斯坦福以人为中心人工智能研究所及其他大学的研究人员齐聚一堂,讨论围绕 GPT-3(当时公开披露的最大稠密语言模型)的开放研究问题。会议在查塔姆研究所规则下进行。讨论者来自多种研究背景,包括计算机科学、语言学、哲学、政治学、传播学、网络政策等。广泛而言,讨论围绕两个主要问题:1)大语言模型的技术能力与局限是什么?2)大语言模型的广泛使用产生了何种社会效应?在此,我们按上述两个主题组织的详细讨论摘要。
引用
@article{arxiv.2102.02503,
title = {Understanding the Capabilities, Limitations, and Societal Impact of Large Language Models},
author = {Alex Tamkin and Miles Brundage and Jack Clark and Deep Ganguli},
journal= {arXiv preprint arXiv:2102.02503},
year = {2021}
}