中文

自然语言处理中偏见与公平性的综述

计算与语言 2022-04-21 v1 人工智能

摘要

随着NLP模型日益融入人们的日常生活,审视这些系统的使用所产生的社会影响变得十分重要。尽管这些模型能理解语言并在困难的下游任务上准确率提升,但有证据表明它们放大了性别、种族和文化刻板印象,并在许多场景中导致恶性循环。本综述中,我们分析偏见的起源、公平性的定义,以及NLP不同子领域如何缓解偏见。最后我们讨论未来研究如何致力于从NLP算法中根除有害偏见。

关键词

引用

@article{arxiv.2204.09591,
  title  = {A Survey on Bias and Fairness in Natural Language Processing},
  author = {Rajas Bansal},
  journal= {arXiv preprint arXiv:2204.09591},
  year   = {2022}
}