大语言模型的虚假信息生成能力
计算与语言
2025-06-13 v2
摘要
自动化虚假信息生成常被视为大语言模型(LLMs)的一项重要风险。理论上,用虚假信息内容淹没信息空间的能力可能对全球社会造成剧烈后果。本文对当前一代 LLM 生成英文虚假新闻文章的能力进行了全面研究。在我们的研究中,我们使用 20 个虚假信息叙事评估了 10 个 LLM 的能力。我们评估了 LLM 的若干方面:生成新闻文章的质量、它们倾向于同意或不同意虚假信息叙事的程度、它们生成安全警告的频率等。我们还评估了检测模型将这些文章检测为 LLM 生成内容的能力。我们得出结论,LLM 能够生成符合危险虚假信息叙事且具有说服力的新闻文章。
引用
@article{arxiv.2311.08838,
title = {Disinformation Capabilities of Large Language Models},
author = {Ivan Vykopal and Matúš Pikuliak and Ivan Srba and Robert Moro and Dominik Macko and Maria Bielikova},
journal= {arXiv preprint arXiv:2311.08838},
year = {2025}
}