低资源语言的单语与多语虚假信息检测综合调查
计算与语言
2025-04-01 v2
摘要
在当今全球数字时代,虚假信息跨越语言边界,为监控系统带来重大挑战。大多数虚假信息检测方法是单语的,聚焦于高资源语言,即已从中获得大量研究投资的几种世界语言。本综述提供了关于低资源语言虚假信息检测研究的全面概述,涵盖单语和多语环境。我们审阅了现有数据集、方法和工具,确定了与数据资源、模型开发、文化和语言背景以及实际应用相关的关键挑战。我们检查了新兴方法,如语言可泛化模型和多模态技术,强调改进数据收集实践、跨学科合作以及加强社会负责 AI 研究激励措施的重要性。我们的发现凸显了能够跨越多样化语言和文化背景解决虚假信息的系统的重要性。
引用
@article{arxiv.2410.18390,
title = {Monolingual and Multilingual Misinformation Detection for Low-Resource Languages: A Comprehensive Survey},
author = {Xinyu Wang and Wenbo Zhang and Sarah Rajtmajer},
journal= {arXiv preprint arXiv:2410.18390},
year = {2025}
}