中文

基于 Bi-GRU-LSTM-CNN 模型的越南语社交媒体文本仇恨言论检测

计算与语言 2019-12-24 v3

摘要

近年来,仇恨言论检测已成为自然语言处理或计算语言学中引人关注的领域之一。在本文中,我们介绍了在 VLSP 2019 共享任务“社交媒体上的仇恨言论检测”中解决该问题的系统描述,该语料库包含 20,345 条人工标注的评论/帖子用于训练,以及 5,086 条用于公开测试。我们将基于 Bi-GRU-LSTM-CNN 分类器的深度学习方法应用于该任务。我们在此任务中的结果为 70.576% 的 F1 分数,在公开测试集上性能排名第 5。

关键词

引用

@article{arxiv.1911.03644,
  title  = {Hate Speech Detection on Vietnamese Social Media Text using the Bi-GRU-LSTM-CNN Model},
  author = {Tin Van Huynh and Vu Duc Nguyen and Kiet Van Nguyen and Ngan Luu-Thuy Nguyen and Anh Gia-Tuan Nguyen},
  journal= {arXiv preprint arXiv:1911.03644},
  year   = {2019}
}

备注

Technical Report, VLSP Workshop 2019