NADI 2020:首届细粒度阿拉伯语方言识别共享任务
计算与语言
2020-11-11 v3 人工智能
摘要
我们呈现首届细粒度阿拉伯语方言识别共享任务(NADI)的结果与发现。该共享任务包含两个子任务:国家层面方言识别(子任务 1)和省级亚方言识别(子任务 2)。共享任务的数据覆盖来自 21 个阿拉伯国家的共 100 个省份,且采集自 Twitter 领域。因此,NADI 是首个针对国家以下层面自然出现的细粒度方言文本的共享任务。共有来自 25 个国家的 61 支队伍注册参与这些任务,反映了学界对该领域的兴趣。我们收到了来自 18 支队伍的 47 份子任务 1 提交,以及来自 9 支队伍的 9 份子任务 2 提交。
引用
@article{arxiv.2010.11334,
title = {NADI 2020: The First Nuanced Arabic Dialect Identification Shared Task},
author = {Muhammad Abdul-Mageed and Chiyu Zhang and Houda Bouamor and Nizar Habash},
journal= {arXiv preprint arXiv:2010.11334},
year = {2020}
}
备注
Accepted in The Fifth Arabic Natural Language Processing Workshop (WANLP 2020)