面向印度语言的仇恨评论检测的多阶段训练方法
计算与语言
2026-05-22 v1 机器学习
摘要
近年来,社交媒体已成为人们交流意见、交换信息和讨论思想的越来越流行的工具。鉴于其广泛存在和深远影响力,社交媒体必须保持安全空间。社交媒体上生成的内容可能包含仇恨言论,越来越需要检测此类内容。本文使用基于语言的预处理方法以及多模型集成,分析其仇恨评论检测性能。通过大量实验,我们提出了一种最小化假阳性率(将非仇恨内容标记为仇恨)的管道,使这些系统能够在不削弱言论自由的前提下检测仇恨评论。
引用
@article{arxiv.2605.22380,
title = {Multi-Stage Training for Abusive Comment Detection in Indic Languages},
author = {Pranshu Rastogi and Madhav Mathur and Ramaneswaran S and Kshitij Mohan},
journal= {arXiv preprint arXiv:2605.22380},
year = {2026}
}
备注
4 pages, EAM2021 selected