PejorativITy:消歧贬义词以提高意大利推文中对仇女言论的检测
计算与语言
2024-04-04 v1 人工智能
摘要
仇女言论常通过隐喻语言表达。一些中性词在作为贬义称呼时可获得负面内涵。消歧此类术语的含义可能有助于仇女言论检测。为解决此任务,我们提出了 PejorativITy,一个包含 1,200 篇经人工标注的意大利推文语料库,用于词级别的贬义语言和句子级别的仇女言论检测。我们评估了将消歧后单词的信息注入针对仇女言论检测的模型中的影响。具体而言,我们探讨了两种不同的注入方法:拼接贬义信息和用单一术语替换模糊单词。我们的实验结果在我们的语料库以及两个流行的意大利推文基准数据集上都表明,这两种方法都导致显著的分类改进,表明词义消歧是仇女言论检测的有前景的初步步骤。此外,我们通过语境词嵌入分析和提示方法探讨了 LLMs 对贬义称呼的理解。
引用
@article{arxiv.2404.02681,
title = {PejorativITy: Disambiguating Pejorative Epithets to Improve Misogyny Detection in Italian Tweets},
author = {Arianna Muti and Federico Ruggeri and Cagri Toraman and Lorenzo Musetti and Samuel Algherini and Silvia Ronchi and Gianmarco Saretto and Caterina Zapparoli and Alberto Barrón-Cedeño},
journal= {arXiv preprint arXiv:2404.02681},
year = {2024}
}