中文

探索大语言模型用于里奥普兰斯西班牙语仇恨言论检测

计算与语言 2024-10-17 v1

摘要

仇恨言论检测涉及多种语言变体、俚语、侮辱性词汇、表达方式以及文化细微差别。这凸显了在自然语言处理领域针对仇恨言论工作时,需针对特定语料库的重要性——这一领域近期因大语言模型的涌现而发生了变革。本文简要分析了大语言模型在里奥普兰斯西班牙语仇恨言论检测中的表现。我们利用链式思考方式,对 ChatGPT 3.5、Mixtral 和 Aya 进行了分类实验,并将其结果与基于 BERT 的最先进分类器进行比较。这些实验表明,尽管大语言模型在精确度方面低于微调的 BERT 分类器,且在某些情况下难以捕捉到隐晦的仇恨词汇或口语化表达,但它们仍能敏感地识别高度细微化的案例(特别是家庭主义/跨性别者仇恨言论)。我们公开代码和模型,以供未来研究使用。

关键词

引用

@article{arxiv.2410.12174,
  title  = {Exploring Large Language Models for Hate Speech Detection in Rioplatense Spanish},
  author = {Juan Manuel Pérez and Paula Miguel and Viviana Cotik},
  journal= {arXiv preprint arXiv:2410.12174},
  year   = {2024}
}