巴达与父权制:评估和缓解南亚语言开放式多语言LLM生成中的偏见
计算与语言
2026-05-07 v2
摘要
大型语言模型(LLM)的评估常常忽略交叉性和文化特定的偏见,尤其是在南亚等 underrepresented 多语言地区。本工作通过对10种印度阿尔韦语和达拉维语的LLM输出进行多语言和交叉性分析,识别出受巴达和父权制影响的文化污名化在生成任务中的再现。我们构建了一个文化基础的偏见词典,捕捉包括性别、宗教、婚姻状态和子女数量等先前未被探索的交叉维度。我们使用词典对交叉偏见和自我去偏置在开放式生成(如讲故事、爱好和待办事项列表)中的有效性进行量化,其中偏见在微妙的方式下显现,在多语言语境中基本未被检视。最后,我们评估了两种自我去偏置策略(简单提示和复杂提示)在印度阿尔韦语和达拉维语中的效果。我们的ethods 提供了一种细致的视角来理解文化偏见,通过引入新颖的偏见词典和评估框架,超越以欧洲中心或小规模多语言设置为主。
引用
@article{arxiv.2505.18466,
title = {Purdah and Patriarchy: Evaluating and Mitigating South Asian Biases in Open-Ended Multilingual LLM Generations},
author = {Mamnuya Rinki and Chahat Raj and Anjishnu Mukherjee and Ziwei Zhu},
journal= {arXiv preprint arXiv:2505.18466},
year = {2026}
}
备注
Accepted to TrustNLP at ACL (Association for Computational Linguistics) 2026