使用前沿语言模型和大语言模型进行文本网络滥用检测的综述
计算与语言
2025-07-03 v1 人工智能
摘要
社交媒体平台的成功促进了数字社区中各种形式在线滥用的出现。这种滥用以多种方式表现,包括仇恨言论、网络欺凌、情感虐待、诱骗和色情短信。在本文中,我们对社交媒体中普遍存在的不同形式的滥用进行了全面分析,特别关注新兴技术,如语言模型和大语言模型,如何重塑这些网络中滥用内容的检测和生成。我们深入探讨了社交媒体滥用得以持续的机制,探索了其心理和社会影响。此外,我们审视了先进语言模型的双重角色——强调它们在增强滥用行为自动检测系统方面的潜力,同时也承认它们生成有害内容的能力。本文旨在为关于在线安全和伦理的持续讨论做出贡献,提供对网络滥用演变格局以及既缓解又加剧它的技术创新的见解。
引用
@article{arxiv.2501.05443,
title = {A survey of textual cyber abuse detection using cutting-edge language models and large language models},
author = {Jose A. Diaz-Garcia and Joao Paulo Carvalho},
journal= {arXiv preprint arXiv:2501.05443},
year = {2025}
}
备注
37 pages, under review in WIREs Data Mining and Knowledge Discovery