“翻译中会遗失仇恨吗?”:多语言 LGBTQIA+ 仇恨言论检测的评估
计算与语言
2025-06-30 v2
摘要
本文探讨了大型语言模型在多语言(包括英语、意大利语、中文及(代码混合的)英语-泰米尔语)上检测 LGBTQIA+ 仇恨言论的挑战,考察了机器翻译的影响以及仇恨言论的细微差异是否在翻译中得以保留。我们检验了零样本和微调 GPT 的仇恨言论检测能力。我们的发现表明:(1) 英语性能最高,英语-泰米尔代码混合场景性能最低;(2) 微调在各语言上均能稳定提升性能,而翻译效果呈现混合态。通过对原始文本和机器翻译文本进行仇恨言论检测的简单实验以及定性错误分析,本文阐明了自动翻译可能无法捕捉的语言社会文化细微差异与复杂性。
引用
@article{arxiv.2410.11230,
title = {"Is Hate Lost in Translation?": Evaluation of Multilingual LGBTQIA+ Hate Speech Detection},
author = {Fai Leui Chan and Duke Nguyen and Aditya Joshi},
journal= {arXiv preprint arXiv:2410.11230},
year = {2025}
}
备注
Under review