EENLP:跨语言东欧 NLP 资源索引
计算与语言
2022-05-12 v3 人工智能
神经与进化计算
摘要
受东欧语言 NLP 资源稀疏性的驱动,我们提出了一个广泛的现有东欧语言资源索引(90+ 数据集与 45+ 模型),以 github 仓库形式发布并开放供社区更新。此外,为支持常识推理任务的评测,我们为部分东欧语言提供了针对五种不同语义任务(即新闻分类、释义检测、自然语言推理(NLI)任务、推文情感检测以及新闻情感检测)手工构建的跨语言数据集。我们使用现有多语言模型在这些数据集上进行了若干实验,以确立性能基线,并将其与其他语言的已有结果进行比较。
引用
@article{arxiv.2108.02605,
title = {EENLP: Cross-lingual Eastern European NLP Index},
author = {Alexey Tikhonov and Alex Malkhasov and Andrey Manoshin and George Dima and Réka Cserháti and Md. Sadek Hossain Asif and Matt Sárdi},
journal= {arXiv preprint arXiv:2108.02605},
year = {2022}
}
备注
Accepted for LREC 2022. 5 pages, 1 figure. Originally EEML 2021 project