泰英代码混合评论中攻击性片段识别共享任务发现
计算与语言
2022-08-01 v1
摘要
攻击性内容审核在社交媒体平台中对于维护健康在线讨论至关重要。然而,其在德拉维达代码混合语言中的研究多局限于对整条评论分类,而未识别其中导致攻击性的部分。该局限主要源于缺乏攻击性片段的标注数据。为此,本共享任务提供了带有攻击性片段标注的泰英代码混合社交评论。本文概述了所发布的数据集、方法及提交系统的结果。
引用
@article{arxiv.2205.06118,
title = {Findings of the Shared Task on Offensive Span Identification from Code-Mixed Tamil-English Comments},
author = {Manikandan Ravikiran and Bharathi Raja Chakravarthi and Anand Kumar Madasamy and Sangeetha Sivanesan and Ratnavel Rajalakshmi and Sajeetha Thavareesan and Rahul Ponnusamy and Shankar Mahadevan},
journal= {arXiv preprint arXiv:2205.06118},
year = {2022}
}
备注
System Description of Shared Task https://competitions.codalab.org/competitions/36395