中文

SemEval-2024任务8:多领域、多模型和多语言机器生成文本检测

计算与语言 2024-04-23 v1

摘要

我们介绍了SemEval-2024任务8:多生成器、多领域和多语言机器生成文本检测的结果和主要发现。该任务包含三个子任务。子任务A是一个二分类任务,判断文本是由人类撰写还是由机器生成。该子任务有两个轨道:一个仅关注英语文本的单语轨道和一个多语言轨道。子任务B是检测文本的确切来源,判断它是由人类撰写还是由特定的LLM生成。子任务C旨在识别文本中的变化点,即作者身份从人类过渡到机器的地方。该任务吸引了大量参与者:子任务A单语(126)、子任务A多语言(59)、子任务B(70)和子任务C(30)。在本文中,我们介绍了任务,分析了结果,并讨论了系统提交及其使用的方法。对于所有子任务,最佳系统都使用了LLM。

关键词

引用

@article{arxiv.2404.14183,
  title  = {SemEval-2024 Task 8: Multidomain, Multimodel and Multilingual Machine-Generated Text Detection},
  author = {Yuxia Wang and Jonibek Mansurov and Petar Ivanov and Jinyan Su and Artem Shelmanov and Akim Tsvigun and Osama Mohammed Afzal and Tarek Mahmoud and Giovanni Puccetti and Thomas Arnold and Chenxi Whitehouse and Alham Fikri Aji and Nizar Habash and Iryna Gurevych and Preslav Nakov},
  journal= {arXiv preprint arXiv:2404.14183},
  year   = {2024}
}

备注

23 pages, 12 tables