中文

学习破译仇恨符号

计算与语言 2019-04-05 v1 人工智能 计算机与社会

摘要

现有的理解仇恨言论的计算模型通常将该问题框定为简单的分类任务,绕过了对仇恨符号(例如14词、kigy)及其隐秘内涵的理解。在本文中,我们提出了一种破译仇恨符号的新任务。为此,我们利用Urban Dictionary并收集了一个新的、富含符号的推特仇恨言论语料库。我们研究了用于破译仇恨符号的神经网络隐上下文模型。更具体地说,我们研究了序列到序列(Sequence-to-Sequence)模型,并展示了它们如何能够基于上下文破解密码。此外,我们提出了一种新颖的变分破译器(Variational Decipher),并展示了在更具挑战性的测试设置中它如何能更好地泛化到未见过的仇恨符号。

关键词

引用

@article{arxiv.1904.02418,
  title  = {Learning to Decipher Hate Symbols},
  author = {Jing Qian and Mai ElSherief and Elizabeth Belding and William Yang Wang},
  journal= {arXiv preprint arXiv:1904.02418},
  year   = {2019}
}