中文

UniCase——重新思考语言模型中的大小写处理

计算与语言 2020-10-23 v1 人工智能

摘要

在本文中,我们提出了一种处理语言建模(LM)中大小写敏感问题的新方法。我们对RoBERTa语言模型进行了简单的架构修改,并配以一种称为统一大小写语言模型(UniCase)的新分词策略。我们在GLUE基准上测试了我们的方案,性能提升了0.42分。此外,我们证明当需要处理所有词元均为大写形式的文本数据时,UniCase模型表现更佳(+5.88分)。

关键词

引用

@article{arxiv.2010.11936,
  title  = {UniCase -- Rethinking Casing in Language Models},
  author = {Rafal Powalski and Tomasz Stanislawek},
  journal= {arXiv preprint arXiv:2010.11936},
  year   = {2020}
}