从狗哨到扩音器:用语言模型揭示隐码修辞
计算与语言
2025-02-26 v1 计算机与社会
摘要
狗哨(dogwhistle)是一种编码表达,同时向广大受众传达一种含义,并向狭窄的内群体传达第二种含义(通常为仇恨性或挑衅性);其被用于规避政治后果与算法内容审核。例如,在句子'我们需要终结世界主义实验'中,'世界主义'一词对许多人可能意为'世俗的',但对少数人则暗指'犹太人'。我们提出了首个关于狗哨的大规模计算研究。我们建立了狗哨的类型学,整理了迄今最大的包含300余条带丰富语境信息与示例的狗哨词汇表,并分析了其在美国历史人物政治演讲中的使用。我们随后评估了大语言模型(GPT-3)能否识别狗哨及其含义,发现GPT-3的性能在不同类型狗哨及目标群体间差异显著。最后,我们表明含有狗哨的有害内容可规避毒性检测,凸显了此类编码语言的在线风险。本工作阐明了狗哨在NLP与计算社会科学中的理论与应用重要性,并为未来建模狗哨及减缓其在线危害的研究提供了资源。
引用
@article{arxiv.2305.17174,
title = {From Dogwhistles to Bullhorns: Unveiling Coded Rhetoric with Language Models},
author = {Julia Mendelsohn and Ronan Le Bras and Yejin Choi and Maarten Sap},
journal= {arXiv preprint arXiv:2305.17174},
year = {2025}
}
备注
ACL 2023, see https://dogwhistles.allen.ai/ for the glossary and other materials