中文

用还是不用 ChatGPT:这是个问题!

机器学习 2023-04-06 v2 人工智能 计算与语言

摘要

ChatGPT 已成为全球现象。随着 ChatGPT 及其他大语言模型(LLMs)的出现,人们对其以各种方式被滥用的担忧与日俱增,例如传播假新闻、剽窃、操纵舆论、作弊和欺诈。因此,区分 AI 生成内容与人类生成内容变得愈发重要。研究者已提出多种检测方法,从基础的二分类器到更复杂的深度学习模型不一而足。部分检测技术依赖统计特征或句法模式,另一些则引入语义或上下文信息以提升准确率。本研究的主要目标是针对最新的 ChatGPT 检测技术提供一份全面且具时效性的评估。此外,我们评估了其他并未明确声称可检测 ChatGPT 生成内容的 AI 文本检测工具,以考察它们在检测 ChatGPT 生成内容时的表现。在评估中,我们构建了一个基准数据集,包含来自 ChatGPT 与人类的提示,涵盖医疗、开放问答和金融领域的多样化问题,以及来自热门社交网络平台的用户生成回复。该数据集作为评估各类技术检测 ChatGPT 生成内容性能的参照。我们的评估结果表明,现有方法均无法有效检测 ChatGPT 生成内容。

关键词

引用

@article{arxiv.2304.01487,
  title  = {To ChatGPT, or not to ChatGPT: That is the question!},
  author = {Alessandro Pegoraro and Kavita Kumari and Hossein Fereidooni and Ahmad-Reza Sadeghi},
  journal= {arXiv preprint arXiv:2304.01487},
  year   = {2023}
}