中文

检测大语言模型生成文本的科学

计算与语言 2023-06-06 v3 人工智能

摘要

大语言模型(LLMs)的出现导致了高度复杂、几乎与人类书写文本难以区分的 LLM 生成文本的产生。然而,这也引发了对这类文本潜在滥用的担忧,例如传播虚假信息与扰乱教育系统。尽管已提出许多检测方法,但对已有成果与挑战的全面理解仍然缺乏。本综述旨在概述现有的 LLM 生成文本检测技术,并加强对语言生成模型的控制与监管。此外,我们强调未来研究的关键考量,包括开发全面的评估指标以及开源 LLM 带来的威胁,以推动 LLM 生成文本检测领域的进展。

关键词

引用

@article{arxiv.2303.07205,
  title  = {The Science of Detecting LLM-Generated Texts},
  author = {Ruixiang Tang and Yu-Neng Chuang and Xia Hu},
  journal= {arXiv preprint arXiv:2303.07205},
  year   = {2023}
}