中文

NADI 2021:第二届细粒度阿拉伯语方言识别共享任务

计算与语言 2021-04-20 v2

摘要

我们呈现第二届细粒度阿拉伯语方言识别共享任务(NADI 2021)的发现与结果。该共享任务包含四个子任务:国家层面的现代标准阿拉伯语(MSA)识别(子任务 1.1)、国家层面的方言识别(子任务 1.2)、省份层面的 MSA 识别(子任务 2.1)和省份层面的次方言识别(子任务 2.2)。共享任务数据集覆盖来自 21 个阿拉伯国家的共 100 个省份,采集自 Twitter 领域。来自 23 个国家的共 53 支队伍注册参与任务,由此反映了社区对该领域的兴趣。我们收到子任务 1.1 的 16 份提交(来自五支队伍)、子任务 1.2 的 27 份提交(来自八支队伍)、子任务 2.1 的 12 份提交(来自四支队伍)以及子任务 2.2 的 13 份提交(来自四支队伍)。

关键词

引用

@article{arxiv.2103.08466,
  title  = {NADI 2021: The Second Nuanced Arabic Dialect Identification Shared Task},
  author = {Muhammad Abdul-Mageed and Chiyu Zhang and AbdelRahim Elmadany and Houda Bouamor and Nizar Habash},
  journal= {arXiv preprint arXiv:2103.08466},
  year   = {2021}
}

备注

arXiv admin note: text overlap with arXiv:2010.11334