中文

面向在线滥用内容检测的伦理设计框架

计算与语言 2020-10-29 v1

摘要

为支持在线通信中的安全与包容,NLP研究已投入大量努力来解决滥用内容检测问题,通常将其定义为一种监督分类任务。研究努力已扩展到多个紧密相关的子领域,例如仇恨言论、毒性、网络欺凌等的检测。迫切需要在任务形式化、数据集设计和性能评估的统一框架下整合该领域。此外,尽管当前技术实现了较高的分类准确率,但已暴露出若干伦理问题。我们将伦理问题置于前沿,并提出一个分为两步的统一框架。首先,围绕个人和身份相关主题对在线内容进行分类。其次,通过每个类别内的比较标注来识别虐待的严重性。该新颖框架以伦理设计(Ethics by Design)原则为指导,是迈向构建更准确和可信模型的步骤。

关键词

引用

@article{arxiv.2010.14952,
  title  = {Towards Ethics by Design in Online Abusive Content Detection},
  author = {Svetlana Kiritchenko and Isar Nejadgholi},
  journal= {arXiv preprint arXiv:2010.14952},
  year   = {2020}
}

备注

14 pages, 2 figures