Universal NER:一个黄金标准多语言命名实体识别基准
计算与语言
2024-07-02 v3
摘要
我们介绍 Universal NER (UNER),一个开放的、社区驱动的项目,旨在开发多种语言的黄金标准 NER 基准。UNER 的总体目标是提供高质量、跨语言一致的标注,以促进并标准化多语言 NER 研究。UNER v1 包含 18 个数据集,以跨语言一致的模式在 12 种不同语言中标注了命名实体。在本文中,我们详述了 UNER 的数据集创建与构成;我们还提供了在语言内与跨语言学习设置下的初始建模基线。我们向公众发布了数据、代码与拟合模型。
引用
@article{arxiv.2311.09122,
title = {Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark},
author = {Stephen Mayhew and Terra Blevins and Shuheng Liu and Marek Šuppa and Hila Gonen and Joseph Marvin Imperial and Börje F. Karlsson and Peiqin Lin and Nikola Ljubešić and LJ Miranda and Barbara Plank and Arij Riabi and Yuval Pinter},
journal= {arXiv preprint arXiv:2311.09122},
year = {2024}
}
备注
NAACL 2024 Camera-ready