直面在线滥用语言:从伦理与人权视角的综述
计算与语言
2021-07-23 v2 人工智能
计算机与社会
摘要
互联网上滥用内容的泛滥可导致严重的心理与身体伤害。自然语言处理(NLP)研究已投入大量精力,通过滥用内容检测及仇恨言论、毒性、网络欺凌等相关子领域来解决该问题。尽管当前技术在研究研究中取得高分类性能,但已观察到该技术的实际部署会造成非预期伤害,例如对代表性不足群体的噤声。我们回顾了大量关于自动滥用检测的 NLP 研究,以新焦点关注伦理挑战,围绕八项既定伦理原则组织:隐私、问责、安全与安保、透明与可解释、公平与非歧视、技术的人类控制、职业责任、以及促进人类价值。在许多情况下,这些原则不仅关联于可能依情境而定的情境伦理准则,实际上更与普世人权重连,如隐私权、免遭歧视权与表达自由权。我们强调需审视该技术的广泛社会影响,并将伦理与人权考量带入应用生命周期的各阶段,从任务制定与数据集设计,到模型训练与评估,再到应用部署。受这些原则引导,我们识别出若干尊重权利、社会技术性的在线滥用检测与应对机会,包括‘轻推’、‘隔离’、价值敏感设计、反叙事、风格迁移与 AI 驱动的公共教育应用。
引用
@article{arxiv.2012.12305,
title = {Confronting Abusive Language Online: A Survey from the Ethical and Human Rights Perspective},
author = {Svetlana Kiritchenko and Isar Nejadgholi and Kathleen C. Fraser},
journal= {arXiv preprint arXiv:2012.12305},
year = {2021}
}
备注
published in Journal of Artificial Intelligence Research, 71: 431-478, July 2021