中文

为语言学研究解析早期现代英语

计算与语言 2020-02-26 v1

摘要

我们探讨了过去几年中 NLP 的进展是否使得可用于历史句法研究的数据规模大幅扩展成为可能。这将 NLP 中的许多常用工具——词嵌入、词性标注与句法分析——结合在一起,服务于对自动标注语料库的语言学查询。我们在一个历史英语语料库上训练了词性(POS)标注器和句法分析器,使用了在超过十亿词规模的相似文本上训练的 ELMo 嵌入。评估基于标准指标,以及使用解析后数据进行查询搜索的准确率。

关键词

引用

@article{arxiv.2002.10546,
  title  = {Parsing Early Modern English for Linguistic Search},
  author = {Seth Kulick and Neville Ryant},
  journal= {arXiv preprint arXiv:2002.10546},
  year   = {2020}
}