中文

预训练语言模型是否感知短语?用于语法归纳的简单而强力的基线

计算与语言 2020-02-04 v1 人工智能 机器学习

摘要

随着预训练语言模型(LM)在自然语言处理中近期的成功与流行,理解其内部机制的努力不断增多。顺应此兴趣,我们提出一种新方法,协助探究预训练 LM 在多大程度上捕获了句法上的成分概念。我们的方法提供了一种无需训练即可从预训练 LM 中提取成分树的有效方式。此外,我们报告了在归纳树中的有趣发现,包括预训练 LM 在正确划分句子中副词短语方面优于其他方法这一事实。

关键词

引用

@article{arxiv.2002.00737,
  title  = {Are Pre-trained Language Models Aware of Phrases? Simple but Strong Baselines for Grammar Induction},
  author = {Taeuk Kim and Jihun Choi and Daniel Edmiston and Sang-goo Lee},
  journal= {arXiv preprint arXiv:2002.00737},
  year   = {2020}
}

备注

ICLR 2020