面向在线滥用内容检测的伦理设计框架
计算与语言
2020-10-29 v1
摘要
为支持在线通信中的安全与包容,NLP研究已投入大量努力来解决滥用内容检测问题,通常将其定义为一种监督分类任务。研究努力已扩展到多个紧密相关的子领域,例如仇恨言论、毒性、网络欺凌等的检测。迫切需要在任务形式化、数据集设计和性能评估的统一框架下整合该领域。此外,尽管当前技术实现了较高的分类准确率,但已暴露出若干伦理问题。我们将伦理问题置于前沿,并提出一个分为两步的统一框架。首先,围绕个人和身份相关主题对在线内容进行分类。其次,通过每个类别内的比较标注来识别虐待的严重性。该新颖框架以伦理设计(Ethics by Design)原则为指导,是迈向构建更准确和可信模型的步骤。
引用
@article{arxiv.2010.14952,
title = {Towards Ethics by Design in Online Abusive Content Detection},
author = {Svetlana Kiritchenko and Isar Nejadgholi},
journal= {arXiv preprint arXiv:2010.14952},
year = {2020}
}
备注
14 pages, 2 figures