中文

MAiDE-up:GPT 生成的酒店评论的多语言欺骗检测

计算与语言 2024-06-21 v2 人工智能

摘要

欺骗性评论正变得越来越普遍,特别是考虑到 LLM 性能的提升和普及。虽然迄今为止的工作已经致力于开发模型来区分真实人类评论和欺骗性人类评论,但对于真实评论与 AI 撰写的虚假评论之间的区别却知之甚少。此外,到目前为止的大多数研究主要集中在英语上,专门针对其他语言的工作非常少。在本文中,我们编制并公开发布了 MAiDE-up 数据集,该数据集包含 10,000 条真实酒店评论和 10,000 条 AI 生成的虚假酒店评论,并在十种语言之间保持平衡。使用该数据集,我们进行了广泛的语言学分析,以 (1) 比较 AI 虚假酒店评论与真实酒店评论,以及 (2) 识别影响欺骗检测模型性能的因素。我们探索了多种模型在三个主要维度(情感、位置和语言)上对酒店评论进行欺骗检测的有效性。我们发现这些维度影响了我们检测 AI 生成的虚假评论的能力。

关键词

引用

@article{arxiv.2404.12938,
  title  = {MAiDE-up: Multilingual Deception Detection of GPT-generated Hotel Reviews},
  author = {Oana Ignat and Xiaomeng Xu and Rada Mihalcea},
  journal= {arXiv preprint arXiv:2404.12938},
  year   = {2024}
}