中文

面向阿拉伯语变体的负责任自然语言标注

计算与语言 2022-03-21 v1 计算机与社会

摘要

在构建 NLP 模型时,往往倾向于追求更广的覆盖面,却常忽视文化与(社会)语言学上的细微差异。在本立场论文中,我们主张应关注并重视此类细微差异,尤其在数据集标注中,并将文化与语言专长纳入该过程。我们提出了一份针对多语体、多方言语言的负责任数据集创建手册。本工作受一项关于阿拉伯语社交媒体内容标注研究的启发。

关键词

引用

@article{arxiv.2203.09597,
  title  = {Towards Responsible Natural Language Annotation for the Varieties of Arabic},
  author = {A. Stevie Bergman and Mona T. Diab},
  journal= {arXiv preprint arXiv:2203.09597},
  year   = {2022}
}

备注

ACL 2022 Findings