中文

使用前沿语言模型和大语言模型进行文本网络滥用检测的综述

计算与语言 2025-07-03 v1 人工智能

摘要

社交媒体平台的成功促进了数字社区中各种形式在线滥用的出现。这种滥用以多种方式表现,包括仇恨言论、网络欺凌、情感虐待、诱骗和色情短信。在本文中,我们对社交媒体中普遍存在的不同形式的滥用进行了全面分析,特别关注新兴技术,如语言模型和大语言模型,如何重塑这些网络中滥用内容的检测和生成。我们深入探讨了社交媒体滥用得以持续的机制,探索了其心理和社会影响。此外,我们审视了先进语言模型的双重角色——强调它们在增强滥用行为自动检测系统方面的潜力,同时也承认它们生成有害内容的能力。本文旨在为关于在线安全和伦理的持续讨论做出贡献,提供对网络滥用演变格局以及既缓解又加剧它的技术创新的见解。

关键词

引用

@article{arxiv.2501.05443,
  title  = {A survey of textual cyber abuse detection using cutting-edge language models and large language models},
  author = {Jose A. Diaz-Garcia and Joao Paulo Carvalho},
  journal= {arXiv preprint arXiv:2501.05443},
  year   = {2025}
}

备注

37 pages, under review in WIREs Data Mining and Knowledge Discovery