中文

泰英代码混合评论中攻击性片段识别共享任务发现

计算与语言 2022-08-01 v1

摘要

攻击性内容审核在社交媒体平台中对于维护健康在线讨论至关重要。然而,其在德拉维达代码混合语言中的研究多局限于对整条评论分类,而未识别其中导致攻击性的部分。该局限主要源于缺乏攻击性片段的标注数据。为此,本共享任务提供了带有攻击性片段标注的泰英代码混合社交评论。本文概述了所发布的数据集、方法及提交系统的结果。

关键词

引用

@article{arxiv.2205.06118,
  title  = {Findings of the Shared Task on Offensive Span Identification from Code-Mixed Tamil-English Comments},
  author = {Manikandan Ravikiran and Bharathi Raja Chakravarthi and Anand Kumar Madasamy and Sangeetha Sivanesan and Ratnavel Rajalakshmi and Sajeetha Thavareesan and Rahul Ponnusamy and Shankar Mahadevan},
  journal= {arXiv preprint arXiv:2205.06118},
  year   = {2022}
}

备注

System Description of Shared Task https://competitions.codalab.org/competitions/36395