面向阿拉伯语变体的负责任自然语言标注
计算与语言
2022-03-21 v1 计算机与社会
摘要
在构建 NLP 模型时,往往倾向于追求更广的覆盖面,却常忽视文化与(社会)语言学上的细微差异。在本立场论文中,我们主张应关注并重视此类细微差异,尤其在数据集标注中,并将文化与语言专长纳入该过程。我们提出了一份针对多语体、多方言语言的负责任数据集创建手册。本工作受一项关于阿拉伯语社交媒体内容标注研究的启发。
引用
@article{arxiv.2203.09597,
title = {Towards Responsible Natural Language Annotation for the Varieties of Arabic},
author = {A. Stevie Bergman and Mona T. Diab},
journal= {arXiv preprint arXiv:2203.09597},
year = {2022}
}
备注
ACL 2022 Findings