Sparks of Artificial General Intelligence:GPT-4 的早期实验
计算与语言
2023-04-17 v5 人工智能
摘要
人工智能(AI)研究者一直在开发并改进大语言模型(LLM),这些模型在多种领域和任务中展现出非凡能力,挑战着我们对学习与认知的理解。OpenAI 开发的最新模型 GPT-4 使用了前所未有的算力和数据规模进行训练。在本文中,我们报告了在 GPT-4 仍处于 OpenAI 积极开发阶段时对其早期版本的调查。我们认为(该早期版本的)GPT-4 属于新一代 LLM(与 ChatGPT 和 Google 的 PaLM 等同属一类),其展现出的智能比以往的 AI 模型更具通用性。我们讨论了这些模型日益增长的能力与影响。我们证明,除精通语言外,GPT-4 无需任何特殊提示即可解决横跨数学、编程、视觉、医学、法律、心理学等诸多领域的新颖困难任务。此外,在所有这些任务中,GPT-4 的表现都惊人地接近人类水平,且常大幅超越 ChatGPT 等先前模型。鉴于 GPT-4 能力的广度与深度,我们认为它可被合理地视为一个人工通用智能(AGI)系统的早期(但仍不完整)版本。在探索 GPT-4 的过程中,我们特别着重于发现其局限性,并讨论了迈向更深层、更全面的 AGI 版本所面临的挑战,包括可能需寻求超越下一词预测的新范式。我们以对近期技术飞跃的社会影响及未来研究方向的思考作结。
引用
@article{arxiv.2303.12712,
title = {Sparks of Artificial General Intelligence: Early experiments with GPT-4},
author = {Sébastien Bubeck and Varun Chandrasekaran and Ronen Eldan and Johannes Gehrke and Eric Horvitz and Ece Kamar and Peter Lee and Yin Tat Lee and Yuanzhi Li and Scott Lundberg and Harsha Nori and Hamid Palangi and Marco Tulio Ribeiro and Yi Zhang},
journal= {arXiv preprint arXiv:2303.12712},
year = {2023}
}