调查土语语言模型中的性别偏见
计算与语言
2025-10-02 v1
摘要
语言模型主要在Web数据上训练,Web数据常包含社会偏见和偏见,模型可能继承这些偏见。这在下游任务或应用中可能产生负面影响。然而,先前的研究主要关注英语语言,尤其是在性别偏见的语境中。特别是,语法上中性语言如土耳其语缺乏探讨,尽管它们代表了不同的语言属性,可能对偏见产生不同影响。本文填补了这一研究空白,调查了土语语言模型中的性别偏见。我们发展现有的偏见评估框架,扩展到土耳其语,通过翻译现有英文测试并创建新的测试,以衡量土耳其语境下性别偏见。具体而言,我们还评估土语语言模型是否存在针对库尔德人的嵌入族群偏见。基于实验结果,我们归因于模型特征,如模型规模、其多语言性以及训练语料库。我们公开土语性别偏见数据集。
引用
@article{arxiv.2404.11726,
title = {Investigating Gender Bias in Turkish Language Models},
author = {Orhun Mersin Caglidil and Malte Ostendorff and Georg Rehm},
journal= {arXiv preprint arXiv:2404.11726},
year = {2025}
}
备注
arXiv admin note: text overlap with arXiv:1903.10561 by other authors