中文

检测 ChatGPT:ChatGPT 生成文本检测现状综述

计算与语言 2023-09-15 v1 人工智能

摘要

尽管以 ChatGPT(OpenAI, 2022)为代表的生成式语言模型在能力与广泛可及性上的近期进展通过生成流畅类人文本带来了诸多益处,但区分人类与大型语言模型(LLM)生成文本的任务已成为一个关键问题。这些模型可能通过生成看似人类所写的人工文本来进行欺骗。该问题在法律、教育和科学等领域尤为突出,这些领域确保文本完整性至关重要。本综述概述了当前用于区分人类与 ChatGPT 生成文本的方法。我们介绍了为检测 ChatGPT 生成文本而构建的不同数据集、所采用的各种方法、针对人类与 ChatGPT 生成文本特征已开展的定性分析,最后将我们的发现总结为一般性见解。

关键词

引用

@article{arxiv.2309.07689,
  title  = {Detecting ChatGPT: A Survey of the State of Detecting ChatGPT-Generated Text},
  author = {Mahdi Dhaini and Wessel Poelman and Ege Erdogan},
  journal= {arXiv preprint arXiv:2309.07689},
  year   = {2023}
}

备注

Published in the Proceedings of the Student Research Workshop associated with RANLP-2023