ChatGPT 一周年:开源大语言模型追上来了吗?
计算与语言
2024-01-17 v4
摘要
2022 年末发布以来,ChatGPT 给整个 AI 领域(研究与商业)带来了地震般的转变。通过对大语言模型(LLM)进行指令微调,结合监督微调与人类反馈强化学习,它展示了一个模型能够在广泛任务上面回答人类问题并遵循指令。在此成功之后,对 LLM 的兴趣急剧升温,学术界与工业界以频繁间隔涌现出新 LLM,包括许多专注于 LLM 的初创公司。尽管闭源 LLM(如 OpenAI 的 GPT、Anthropic 的 Claude)通常优于其开源对应模型,但后者进展迅速,声称在特定任务上达到持平甚至更优。这不仅对研究而且对商业具有关键影响。在这项工作中,值 ChatGPT 一周年之际,我们提供这一成功的详尽概览,调研所有开源 LLM 声称与 ChatGPT 持平或更优的任务。
引用
@article{arxiv.2311.16989,
title = {ChatGPT's One-year Anniversary: Are Open-Source Large Language Models Catching up?},
author = {Hailin Chen and Fangkai Jiao and Xingxuan Li and Chengwei Qin and Mathieu Ravaut and Ruochen Zhao and Caiming Xiong and Shafiq Joty},
journal= {arXiv preprint arXiv:2311.16989},
year = {2024}
}
备注
version v4, included latest top-performing open-sourced LLMs