THOS:一个面向定向仇恨与攻击性言论的基准数据集
计算与语言
2023-11-14 v1 人工智能
摘要
在社交媒体(如 Twitter)上检测有害内容因看似简单的二分类背后隐藏大量复杂性而困难重重。遗憾的是,尽管已收集若干用于训练仇恨与攻击性言论分类器的数据集,但带有更细粒度目标类别与具体目标的标注数据集仍十分匮乏。本文中,我们介绍 THOS,一个包含 8.3k 条推文的数据集,其手动标注了关于消息目标的细粒度注释。我们证明,该数据集使得基于大语言模型(LLM)训练分类器以如此细粒度水平进行分类成为可能。
引用
@article{arxiv.2311.06446,
title = {THOS: A Benchmark Dataset for Targeted Hate and Offensive Speech},
author = {Saad Almohaimeed and Saleh Almohaimeed and Ashfaq Ali Shafin and Bogdan Carbunar and Ladislau Bölöni},
journal= {arXiv preprint arXiv:2311.06446},
year = {2023}
}