中文

通过盲审评审员与文本分类算法比较 ChatGPT 生成的抽取式摘要与真实摘要

计算与语言 2023-08-29 v3

摘要

大型语言模型(LLMs)因其在多种任务上的出色表现而备受关注。由 OpenAI 开发的 ChatGPT 是语言模型家族的最新成员,因其类人文本生成能力而被一些人称为颠覆性技术。尽管互联网上已有许多评估 ChatGPT 优缺点的事例,但系统的研究寥寥无几。为丰富 ChatGPT 系统研究的文献,我们通过自动化指标和盲审人类评审员评估了 ChatGPT 在抽取式摘要上的表现。我们还构建了自动文本分类器来检测 ChatGPT 生成的摘要。我们发现,虽然文本分类算法能够区分真实摘要与生成摘要,但人类无法区分真实摘要与 ChatGPT 生成的摘要。

关键词

引用

@article{arxiv.2303.17650,
  title  = {Comparing Abstractive Summaries Generated by ChatGPT to Real Summaries Through Blinded Reviewers and Text Classification Algorithms},
  author = {Mayank Soni and Vincent Wade},
  journal= {arXiv preprint arXiv:2303.17650},
  year   = {2023}
}