社会偏见框架:关于语言的社会与权力意涵的推理
计算与语言
2020-04-27 v3
摘要
警告:本文包含可能令人不适或不安的内容。语言有能力强化刻板印象并将社会偏见投射到他人身上。这一挑战的核心在于,很少是明确陈述的内容,而是隐含意义框定了人们对他人的判断。例如,给定陈述“我们不应降低标准以雇佣更多女性”,大多数听者会推断出说话者意图的含意——即“女性(候选人)资质较差”。迄今为止,大多数语义形式化方法并未捕捉此类语用含意,即人们在语言中表达社会偏见与权力差异的方式。我们引入社会偏见框架(Social Bias Frames),一种旨在建模人们将社会偏见与刻板印象投射到他人身上的语用框架的新概念形式化方法。此外,我们引入社会偏见推断语料库(Social Bias Inference Corpus),以支持大规模建模与评估,包含对社交媒体帖子的15万条结构化标注,覆盖关于上千个人口群体的超过3.4万条含意。我们随后建立了从非结构化文本中恢复社会偏见框架的基线方法。我们发现,虽然最先进的神经模型在高层分类给定陈述是否投射不良社会偏见方面有效(80% F1),但它们在根据社会偏见框架详述更细致的解释方面并不有效。我们的研究激励了未来将结构化语用推断与社会意涵的常识推理相结合的工作。
引用
@article{arxiv.1911.03891,
title = {Social Bias Frames: Reasoning about Social and Power Implications of Language},
author = {Maarten Sap and Saadia Gabriel and Lianhui Qin and Dan Jurafsky and Noah A. Smith and Yejin Choi},
journal= {arXiv preprint arXiv:1911.03891},
year = {2020}
}
备注
ACL 2020 Camera Ready; Data available at http://tinyurl.com/social-bias-frames