中文

根据法律标准的仇恨言论:一种有效检测分析

计算与语言 2024-12-10 v1

摘要

仇恨言论的问题超越了线上领域,它具有现实生活中的后果,促使大多数国家制定法律框架,将仇恨言论定为可惩罚的犯罪。这些法律框架因国家而异,导致在处理在线平台上报告的仇恨言论实例时面临巨大混乱。由于仇恨言论定义不足以建立稳健的框架,我们转向仇恨言论法律。我们咨询了法律专家对仇恨言论数据集的意见,并通过多种方法进行实验,包括在仇恨言论和法律数据上使用的预训练模型,以及利用两大大语言模型(Qwen2-7B-Instruct 和 Meta-Llama-3-70B)。由于为可起诉的仇恨言论获取数据的代价高昂,我们使用伪标签来提高预训练模型的性能。本研究突显了放大可起诉仇恨言论研究的重要性,并为在法律框架内对抗仇恨言论提供了有效策略。我们的发现表明,以形式呈现的法律知识在分类可起诉仇恨言论方面具有实用性,但应更加关注不同国家法律之间的差异。

关键词

引用

@article{arxiv.2412.06144,
  title  = {Hate Speech According to the Law: An Analysis for Effective Detection},
  author = {Katerina Korre and John Pavlopoulos and Paolo Gajo and Alberto Barrón-Cedeño},
  journal= {arXiv preprint arXiv:2412.06144},
  year   = {2024}
}